Lição 7 de 7 · 6 min

Os riscos próprios dos grandes modelos de linguagem

Dimensão dos corpora, fluência enganadora e concentração do poder: as críticas que marcaram a área.

ObjetivoExplicar os principais riscos levantados pelos grandes modelos e as salvaguardas correspondentes.

Em 2021, o artigo «On the Dangers of Stochastic Parrots» alerta contra a corrida ao tamanho. Os autores sublinham vários riscos. Corpora imensos são impossíveis de documentar por completo e trazem conteúdos enviesados ou tóxicos. Um texto fluente inspira confiança mesmo quando é falso. O custo destes modelos concentra o poder em poucos intervenientes.

  • Fluência enganadora: exigir as fontes e verificar os factos essenciais.
  • Corpora opacos: preferir os fornecedores que documentam os seus dados e os seus limites.
  • Dependência: manter a possibilidade de mudar de modelo e de executar a IA nos seus próprios servidores.

Referências

  1. Bender, Gebru, McMillan-Major, Shmitchell (2021). On the Dangers of Stochastic Parrots: Can Language Models Be Too Big?. Proceedings of ACM FAccT 2021, p. 610–623. doi.org/10.1145/3442188.3445922