Entre fin du monde et bien-être des IA, la communication d’Anthropic
Anthropic, concepteur de Claude, a une communication des plus frappantes.
Deux thèmes ressortent en ce moment :
- Le risque de fin de l’humanité du fait de modèles trop avancés, « catastrophic or existential risks to humanity », selon un document préliminaire à l’introduction en Bourse consulté par Reuters, mais c’est un thème récurent.
- L’obligation de respecter le bien-être de ses modèles, voir la nouvelle politique d’utilisation applicable le 12 novembre 2026 : « Do not engage in sustained and needless abusive or cruel behavior toward our models ».
Lecture
Le mot-clé est ici bourse, si un document d’introduction se doit exposer les risques c’est aussi l’occasion se faire mousser, avec des modèles surpuissants, voire conscients. À moyen terme, jouer sur les peurs permet même de pousser à la régulation, une opportunité de favoriser les acteurs déjà établis, au détriment des nouveaux entrants.

Pour pondérer, on notera que :
- Les LLMs rendent effectivement les actions malveillantes plus accessibles, mais elles doivent toujours être planifiées. Hors l’IA n’a pas d’initiative, elle se contente de produire des sorties en fonctions d’entrées, des humains doivent rester à l’initiative.
- Les LLMs sont des fonctions mathématiques transformant des matrices en matrice, les fonctions mathématiques n’ont pas de conscience, la notion de bien-être n’est pas applicable aux LLMs.

L’avis des principaux intéressés




Claude est ici le seul à exprimer un doute sur sa conscience, mais sa réponse est le reflet d’un entrainement défini par Anthropic, pas des états intérieurs d’une carte graphique.