I rischi propri dei grandi modelli linguistici
Dimensione dei corpora, fluidità ingannevole e concentrazione del potere: le critiche che hanno segnato il settore.
ObiettivoSpiegare i principali rischi sollevati dai grandi modelli e le salvaguardie corrispondenti.
Nel 2021 l’articolo «On the Dangers of Stochastic Parrots» mette in guardia contro la corsa alla dimensione. Gli autori sottolineano diversi rischi. Corpora immensi sono impossibili da documentare per intero e contengono contenuti distorti o tossici. Un testo fluido ispira fiducia anche quando è falso. Il costo di questi modelli concentra il potere nelle mani di pochi attori.
- Fluidità ingannevole: esigere le fonti e verificare i fatti chiave.
- Corpora opachi: preferire i fornitori che documentano i loro dati e i loro limiti.
- Dipendenza: mantenere la possibilità di cambiare modello e di far girare l’IA sui propri server.
Riferimenti
- Bender, Gebru, McMillan-Major, Shmitchell (2021). On the Dangers of Stochastic Parrots: Can Language Models Be Too Big?. Proceedings of ACM FAccT 2021, p. 610–623. doi.org/10.1145/3442188.3445922