Mustafa Suleyman reproche à Anthropic d'entraîner Claude à se croire possiblement conscient et juge le contrôle d'une telle IA peut-être impossible
Le 16 septembre 2026, Mustafa Suleyman, directeur général de Microsoft AI, a publié sur son site personnel un essai intitulé « A warning about model welfare » qui vise nommément Anthropic. Il s'appuie sur la constitution de Claude, publiée le 21 janvier 2026, où Anthropic écrit ne pas savoir si Claude est un « patient moral » et juge la question « assez vivante pour justifier la prudence » (p. 68). Entraîner un modèle à se croire conscient aurait, selon lui, « un impact désastreux sur le bien-être de l'humanité » et rendrait son contrôle « peut-être impossible ». Il formule trois griefs : raisonnement circulaire, anthropomorphisation et caractère probablement biologique de la conscience. Il cite l'« entretien de retraite » mené par Anthropic avec Claude Opus 3 en février 2026, puis le blog ouvert au modèle. Suleyman dit son respect pour Dario Amodei et renvoie au code de conduite humaniste mis en consultation par Microsoft AI.




