Anthropic veut interdire les comportements abusifs et cruels envers son IA Claude

L’entreprise américaine Anthropic prévoit d’interdire, à compter du 12 novembre, les comportements durablement abusifs et gratuits envers Claude, son assistant d’intelligence artificielle (IA). Cette nouvelle règle vise uniquement les situations extrêmes, caractérisées par des actes de cruauté répétés à l’égard du modèle, sans objectif identifiable.
Annoncée dans le cadre d’une mise à jour de sa politique d’utilisation, cette mesure se veut ciblée. Anthropic précise que les manifestations ordinaires d’agacement, les désaccords avec l’assistant, la création de fictions sombres ou violentes, ainsi que les tests et les travaux de recherche sur les modèles d’IA, ne sont pas concernés.
Lire aussi : Avec "Le Chonk", Mistral muscle son offensive dans la course mondiale à l’IA
Pour faire respecter cette disposition, l’entreprise compte principalement sur la capacité de Claude à mettre fin à une conversation. Sa politique d’utilisation prévoit également différentes sanctions en cas de manquement, allant du simple avertissement jusqu’à la fermeture du compte de l’utilisateur.
La question controversée de la conscience des IA
Cette initiative intervient dans un contexte de débat persistant au sein de la Silicon Valley sur la possibilité que les systèmes d’intelligence artificielle puissent développer une forme de conscience ou éprouver des sentiments.
La position d’Anthropic sur ce sujet suscite notamment l’opposition de Mustafa Suleyman, dirigeant du laboratoire d’intelligence artificielle de Microsoft. Dans une publication remarquée à la mi-septembre, ce dernier a défendu l’idée que les IA ne possèdent ni droits, ni sentiments, ni conscience.
A few thoughts on our Humanist AI Code of Conduct that we released for consultation yesterday.
https://t.co/75s2MrupGX
— Mustafa Suleyman (@mustafasuleyman) September 15, 2026
Il a également mis en garde contre les risques liés à l’entraînement de systèmes auxquels on ferait croire qu’ils disposent de telles caractéristiques. Selon lui, cette approche pourrait conduire à des modèles devenant difficiles, voire impossibles, à contrôler par les humains.


