Leçon 7 sur 7 · 15 min

Les risques propres aux grands modèles de langage

Taille des corpus, fluidité trompeuse et concentration du pouvoir : les critiques qui ont marqué le domaine.

ObjectifExpliquer les principaux risques soulevés par les grands modèles et les garde-fous correspondants.

En 2021, l’article « On the Dangers of Stochastic Parrots » met en garde contre la course à la taille. Les auteurs y soulignent plusieurs risques. Des corpus immenses sont impossibles à documenter entièrement et embarquent des contenus biaisés ou toxiques. Un texte fluide inspire confiance même quand il est faux. Le coût de ces modèles concentre le pouvoir chez quelques acteurs.

  • Fluidité trompeuse : exiger les sources et vérifier les faits clés.
  • Corpus opaques : préférer les fournisseurs qui documentent leurs données et leurs limites.
  • Dépendance : garder la possibilité de changer de modèle et de faire tourner l’IA sur ses propres serveurs.

Références

  1. Bender, Gebru, McMillan-Major, Shmitchell (2021). On the Dangers of Stochastic Parrots: Can Language Models Be Too Big?. Proceedings of ACM FAccT 2021, p. 610–623. doi.org/10.1145/3442188.3445922