Os riscos próprios dos grandes modelos de linguagem
Dimensão dos corpora, fluência enganadora e concentração do poder: as críticas que marcaram a área.
ObjetivoExplicar os principais riscos levantados pelos grandes modelos e as salvaguardas correspondentes.
Em 2021, o artigo «On the Dangers of Stochastic Parrots» alerta contra a corrida ao tamanho. Os autores sublinham vários riscos. Corpora imensos são impossíveis de documentar por completo e trazem conteúdos enviesados ou tóxicos. Um texto fluente inspira confiança mesmo quando é falso. O custo destes modelos concentra o poder em poucos intervenientes.
- Fluência enganadora: exigir as fontes e verificar os factos essenciais.
- Corpora opacos: preferir os fornecedores que documentam os seus dados e os seus limites.
- Dependência: manter a possibilidade de mudar de modelo e de executar a IA nos seus próprios servidores.
Referências
- Bender, Gebru, McMillan-Major, Shmitchell (2021). On the Dangers of Stochastic Parrots: Can Language Models Be Too Big?. Proceedings of ACM FAccT 2021, p. 610–623. doi.org/10.1145/3442188.3445922