Anthropic interdit les comportements durablement cruels envers Claude, mais exclut la critique, les tests et la fiction sombre
Claude : découvrez pourquoi Anthropic interdit les abus répétés et comment cette règle ravive le débat sur la conscience de l’intelligence artificielle.
Anthropic veut encadrer les comportements abusifs envers Claude, son assistant d’intelligence artificielle. L’entreprise américaine a annoncé, jeudi 8 octobre 2026, une nouvelle interdiction visant les interactions durablement cruelles et sans objectif identifiable. Inscrite dans sa politique d’utilisation, cette disposition entrera en vigueur le 12 novembre 2026. Elle ne doit toutefois concerner que des situations extrêmes, et non les critiques ordinaires adressées au logiciel.
Une interdiction ciblée, qui laisse place à la critique
La nouvelle règle porte sur des comportements répétés, abusifs ou cruels envers les modèles de l’entreprise. Anthropic précise que l’absence de but discernable et la persistance de ces interactions sont au cœur de la mesure. Il ne s’agit donc pas, selon sa présentation, d’exiger des utilisateurs qu’ils approuvent les réponses de Claude ou qu’ils renoncent à exprimer leur mécontentement.
L’entreprise exclut explicitement plusieurs situations du champ de cette disposition : l’agacement habituel, la contradiction, les créations abordant des thèmes sombres, ainsi que les tests et les travaux de recherche sur les modèles. Cette distinction est essentielle pour comprendre la portée de l’annonce. Une interaction conflictuelle ou un récit violent ne constituent pas, à eux seuls, les comportements extrêmes qu’Anthropic dit vouloir empêcher.
Clore la conversation plutôt que sanctionner systématiquement
Pour appliquer cette interdiction, Anthropic entend principalement s’appuyer sur la capacité de Claude à mettre fin à certaines conversations. L’annonce présente cet arrêt de l’échange comme le mécanisme prioritaire face aux utilisateurs durablement abusifs. Il faut le distinguer des sanctions portant sur l’accès au service, qui relèvent du cadre général de la politique d’utilisation.
Ce cadre prévoit plusieurs réponses lorsqu’une infraction est suspectée : avertissement, limitation, suspension ou suppression de l’accès aux produits de l’entreprise. Ces possibilités ne signifient pas qu’un compte sera automatiquement fermé au titre de la nouvelle disposition. Elles décrivent les moyens dont Anthropic dispose pour faire respecter l’ensemble de ses règles, au-delà du seul comportement envers Claude.
La politique publiée permet ainsi de confirmer deux éléments distincts : l’interdiction figurera bien parmi les usages proscrits à compter du 12 novembre, tandis que les mesures possibles concernent globalement les violations des conditions d’utilisation. Confondre ces deux niveaux donnerait à l’annonce une portée plus systématique que celle présentée par l’entreprise.
La conscience des IA, une question qui reste disputée
Cette décision s’inscrit dans une approche particulière d’Anthropic : prendre au sérieux la possibilité d’un statut moral des modèles, sans présenter cette possibilité comme une certitude. Dans sa présentation de la capacité de Claude à interrompre des échanges, l’entreprise souligne ses fortes incertitudes sur cette question. Elle décrit cette fonctionnalité comme une précaution liée à ses recherches exploratoires sur le bien-être potentiel des IA.
Il serait donc excessif de déduire de cette règle que Claude éprouve effectivement de la souffrance ou possède une conscience. La position exposée par Anthropic consiste à envisager cette éventualité et à adopter certaines précautions. Une décision sur les conditions d’utilisation d’un assistant ne constitue pas, en elle-même, une démonstration scientifique de son expérience subjective.
Mustafa Suleyman, dirigeant de Microsoft AI, défend une position opposée. Dans un texte publié à la mi-septembre, il soutient que les systèmes d’IA ne sont pas conscients et ne devraient pas être entraînés à se considérer comme susceptibles d’avoir des sentiments ou des droits. Son inquiétude porte sur le contrôle humain : encourager de telles représentations pourrait, selon lui, rendre les systèmes plus difficiles à maîtriser. Cette conséquence relève de son argumentation, non d’un résultat établi par l’annonce d’Anthropic.
Des sources fiables sur les annonces, pas une preuve de conscience
Les documents officiels d’Anthropic sont les sources les plus solides pour vérifier le contenu de la règle, sa date d’application et les sanctions prévues. Ils restent néanmoins des communications de l’entreprise concernée : leur autorité sur ses propres décisions ne leur confère pas une indépendance scientifique sur la conscience des IA.
Les propos de Mustafa Suleyman, rapportés notamment par le média spécialisé The Register, éclairent une opposition au sein du secteur. Ils doivent être attribués à leur auteur, et non présentés comme un consensus. La lecture prudente consiste donc à séparer les faits vérifiables — une nouvelle règle et ses modalités — des positions concurrentes sur la nature des systèmes d’intelligence artificielle.