Les risques propres aux grands modèles de langage
Taille des corpus, fluidité trompeuse et concentration du pouvoir : les critiques qui ont marqué le domaine.
ObiettivoExpliquer les principaux risques soulevés par les grands modèles et les garde-fous correspondants.
En 2021, l’article « On the Dangers of Stochastic Parrots » met en garde contre la course à la taille. Les auteurs y soulignent plusieurs risques. Des corpus immenses sont impossibles à documenter entièrement et embarquent des contenus biaisés ou toxiques. Un texte fluide inspire confiance même quand il est faux. Le coût de ces modèles concentre le pouvoir chez quelques acteurs.
- Fluidité trompeuse : exiger les sources et vérifier les faits clés.
- Corpus opaques : préférer les fournisseurs qui documentent leurs données et leurs limites.
- Dépendance : garder la possibilité de changer de modèle et de faire tourner l’IA sur ses propres serveurs.
Riferimenti
- Bender, Gebru, McMillan-Major, Shmitchell (2021). On the Dangers of Stochastic Parrots: Can Language Models Be Too Big?. Proceedings of ACM FAccT 2021, p. 610–623. doi.org/10.1145/3442188.3445922