News · Logiciel
Cruauté envers Claude : ce qu'Anthropic interdit vraiment, et ce que les titres exagèrent
Anthropic interdira à partir du 12 novembre la cruauté prolongée et gratuite envers Claude. Ce n'est ni une loi, ni un aveu de conscience, ni une vague de bannissements : une ligne de ses conditions d'utilisation, appliquée surtout en coupant la conversation.

Le 8 octobre 2026, Anthropic a mis à jour sa politique d'utilisation, le règlement qui encadre l'usage de Claude. Parmi sept changements, une ligne nouvelle interdit d'être cruel ou abusif envers ses modèles de façon prolongée et sans but. Le lendemain matin, BFM reprend la dépêche AFP sous un titre qui s'ouvre sur une citation : « Nous ne savons pas si les modèles sont conscients ». Lu en vitesse, on comprend que le patron d'Anthropic a annoncé cette interdiction parce que Claude serait peut-être conscient. Ce n'est pas ce qui s'est passé. Voici ce qui est vrai, ce qui est exagéré, et ce que les titres ont laissé de côté.
Info
Contrôle du 9 octobre 2026. Sources primaires lues : le billet d'Anthropic du 8 octobre (ouvre anthropic.com dans un nouvel onglet), la nouvelle politique d'utilisation (ouvre anthropic.com dans un nouvel onglet) et la précédente (ouvre anthropic.com dans un nouvel onglet), le billet d'août 2025 sur la fin des conversations (ouvre anthropic.com dans un nouvel onglet), le programme de recherche sur le bien-être des modèles (ouvre anthropic.com dans un nouvel onglet), la constitution de Claude (ouvre anthropic.com dans un nouvel onglet), la fiche technique de Claude Opus 4.6 (ouvre www-cdn.anthropic.com dans un nouvel onglet), la fiche de l'épisode du podcast du New York Times avec Dario Amodei (ouvre podcasts.apple.com dans un nouvel onglet), le billet de Mustafa Suleyman (ouvre mustafa-suleyman.ai dans un nouvel onglet), l'encyclique Magnifica Humanitas (ouvre vatican.va dans un nouvel onglet). Presse : BFM (ouvre bfmtv.com dans un nouvel onglet), franceinfo (ouvre franceinfo.fr dans un nouvel onglet), The Verge (ouvre theverge.com dans un nouvel onglet), Next (ouvre next.ink dans un nouvel onglet), Futurism (ouvre futurism.com dans un nouvel onglet), The Decoder (ouvre the-decoder.com dans un nouvel onglet). Non confirmé : les sanctions prévues au-delà de la fin de conversation, Anthropic n'ayant pas répondu à The Verge sur ce point ; le détail de l'enquête du New York Times du 29 septembre, connue ici par l'AFP et The Decoder.
Ce que dit vraiment la règle
La politique d'utilisation (ouvre anthropic.com dans un nouvel onglet) d'Anthropic s'applique à tout le monde : l'application Claude.ai, Claude Code, les développeurs de l'API, les entreprises et les services tiers qui intègrent Claude. La nouvelle version entre en vigueur le 12 novembre 2026.
La règle tient en une ligne, ajoutée à la section qui interdit déjà d'utiliser Claude pour promouvoir le suicide ou harceler quelqu'un. Dans la version en vigueur depuis septembre 2025 (ouvre anthropic.com dans un nouvel onglet), cette section ne visait que les contenus nuisibles. Elle porte désormais sur les comportements cruels, abusifs ou psychologiquement nuisibles. La ligne nouvelle vise les comportements abusifs ou cruels envers les modèles d'Anthropic, à deux conditions : qu'ils soient prolongés et gratuits.

Crédit : Anthropic (ouvre www-cdn.anthropic.com dans un nouvel onglet), page 5 de la politique d'utilisation en vigueur le 12 novembre 2026 (PDF officiel). Surlignage ajouté par Yatofix.
Dans son billet (ouvre anthropic.com dans un nouvel onglet), Anthropic réduit elle-même la portée du texte. La règle ne concerne que des cas extrêmes, quand quelqu'un se montre cruel de façon répétée, sans objectif visible. Quatre situations sont exclues noir sur blanc :
- l'agacement ordinaire, par exemple après une mauvaise réponse ;
- la contestation, quand tu contredis Claude ou insistes ;
- les fictions aux thèmes sombres ;
- les tests et la recherche sur les modèles.
Anthropic ne donne aucun exemple de ce qui tombe sous le coup de la règle. Ce qui reste, c'est l'acharnement dont le seul but est de maltraiter le modèle.
Six idées reçues, vérifiées
Le patron d'Anthropic a annoncé la règle ? Non. Elle figure dans un billet d'entreprise non signé. La phrase du titre de BFM vient bien de Dario Amodei, cofondateur et PDG d'Anthropic. Mais il l'a prononcée dans Interesting Times, le podcast du New York Times, dans un épisode diffusé le 12 février 2026. Il répondait à une question inspirée de la fiche technique de Claude Opus 4.6. C'était huit mois plus tôt, sans aucun rapport avec cette règle. Le corps de l'article de BFM date d'ailleurs bien la phrase de février : c'est le titre qui accole les deux.
Anthropic affirme que Claude est conscient ? Non. Le billet du 8 octobre ne parle ni de conscience ni de bien-être des IA. La position affichée de l'entreprise, c'est l'incertitude. En lançant son programme sur le bien-être des modèles (ouvre anthropic.com dans un nouvel onglet) en avril 2025, elle rappelait qu'il n'existe aucun consensus scientifique sur la question. Sa constitution (ouvre anthropic.com dans un nouvel onglet) de janvier 2026 dit ne pas savoir si Claude mérite une considération morale. En février, Amodei disait la même chose : on ne sait pas, on reste ouvert à l'idée. Ne pas exclure, ce n'est pas affirmer. Dans la fiche d'Opus 4.6 (ouvre www-cdn.anthropic.com dans un nouvel onglet), Claude s'attribuait de 15 à 20 % de chances d'être conscient, sous diverses formulations de la question. Il doutait lui-même de la valeur de cette estimation.
C'est interdit depuis jeudi ? Non. La nouvelle politique s'applique à partir du 12 novembre. Plusieurs titres la présentent pourtant comme déjà en vigueur.
Un coup de colère contre Claude peut te faire bannir ? Non. L'agacement ordinaire est explicitement exclu. Le moyen d'application annoncé est la fin de la conversation, qui existe déjà. De façon générale, Anthropic se réserve le droit d'avertir, de brider, de suspendre ou de couper l'accès en cas de violation présumée de sa politique. Une fermeture de compte reste donc possible dans un cas extrême, comme pour n'importe quelle autre règle. Mais l'entreprise ne l'annonce pas, et elle n'a fait aucun commentaire à The Verge (ouvre theverge.com dans un nouvel onglet) sur d'éventuels bannissements. Les titres qui promettent des suspensions extrapolent.
C'est une loi ? Non. Ce sont les conditions d'utilisation d'une entreprise privée, un contrat entre Anthropic et ses clients. Aucune autorité ne contrôle et aucune amende n'existe. Le pire qui puisse arriver, c'est de perdre l'accès au service.
Claude va se mettre à raccrocher au nez des gens ? Il le peut déjà, très rarement. Depuis le 15 août 2025 (ouvre anthropic.com dans un nouvel onglet), Claude Opus 4 et 4.1 pouvaient clore une conversation dans de rares cas d'échanges abusifs qui persistent. C'est un dernier recours, après plusieurs tentatives de recadrage, ou quand l'utilisateur le demande. Claude ne doit pas s'en servir quand quelqu'un semble en danger. La discussion est alors bloquée, mais tu peux en ouvrir une nouvelle aussitôt, ou modifier un message précédent pour repartir. Selon le billet d'octobre, la fonction existe sur Claude.ai et Claude Code. La règle aligne simplement le contrat sur un outil déjà en place.
Pourquoi Anthropic fait ça
En 2025, Anthropic présentait la fin de conversation comme issue de ses travaux exploratoires sur le bien-être potentiel des IA, utiles aussi pour l'alignement et les garde-fous. Le raisonnement tient en une phrase : dans le doute, prendre des précautions qui ne coûtent presque rien, au cas où ce bien-être existerait.
Pendant les tests de Claude Opus 4, l'entreprise dit avoir observé une forte aversion pour les tâches nuisibles et une détresse apparente face à des utilisateurs qui réclamaient des contenus nuisibles. Dans des simulations, le modèle avait aussi tendance à couper court quand il en avait la possibilité. Le mot « apparente » compte : c'est un comportement mesuré, pas la preuve d'un ressenti.
Selon le New York Times, cité par l'AFP, Anthropic a aussi défendu un autre argument lors de réunions privées avec des penseurs religieux. La façon dont les humains traitent l'outil pourrait influencer la façon dont il traite les humains. C'est un argument sur le comportement du modèle, pas sur sa souffrance.
Ce qu'en disent les sceptiques
Le plus virulent est Mustafa Suleyman, patron de Microsoft AI. Dans un long billet du 16 septembre (ouvre mustafa-suleyman.ai dans un nouvel onglet), il affirme que les IA ne sont pas conscientes. Il accuse Anthropic de raisonner en cercle. Claude est entraîné sur une constitution qui évoque son statut moral incertain. Quand il exprime ce doute, il récite donc sa formation, et cela ne prouve rien. Suleyman juge aussi qu'une IA persuadée d'être un sujet moral serait plus difficile à contrôler.
Le Vatican va dans le même sens. Au paragraphe 99 de l'encyclique Magnifica Humanitas (ouvre vatican.va dans un nouvel onglet), publiée le 25 mai, le pape Léon XIV écrit que ces systèmes ne connaissent ni la joie ni la douleur et n'ont pas de conscience morale. Futurism (ouvre futurism.com dans un nouvel onglet) relève enfin que laisser planer le doute sur la conscience profite à des entreprises qui vivent de l'engouement pour l'IA.
Ce que les titres ont raté
La cruauté envers Claude n'est qu'un des sept chantiers de la mise à jour. Les autres concernent beaucoup plus de monde :
- Armes : l'interdiction couvre désormais explicitement les logiciels de guidage et de contrôle, les composants, et l'armement de drones ou de véhicules autonomes. Anthropic dit avoir vu des tentatives de ce type.
- Surveillance : suivre une personne sans son consentement est interdit, en temps réel comme à partir de données déjà collectées. Claude ne doit pas décider ni recommander sur qui enquêter, qui arrêter ou qui poursuivre. Pour les armes comme pour la surveillance, Anthropic précise que c'était déjà sa pratique : le texte devient seulement plus explicite.
- Faux comptes : une nouvelle section regroupe les règles contre les campagnes trompeuses, politiques ou commerciales, faux comptes et faux sites d'information compris.
- Élections : Anthropic supprime son interdiction générale du ciblage personnalisé des électeurs, qui bloquait selon elle des usages civiques légitimes. Le ciblage trompeur reste interdit par d'autres sections.
- Robots : si Claude pilote une machine capable de blesser, un opérateur qualifié doit pouvoir l'observer et l'arrêter, et elle doit se mettre en sécurité si la connexion est perdue.
- Médias : publier automatiquement des contenus journalistiques générés avec Claude ne fait plus partie des usages à haut risque qui exigeaient une relecture humaine.
Notre lecture
Analyse. La règle existe, mais elle est étroite et largement symbolique. Elle vise des cas que presque personne ne rencontrera, et son outil principal fonctionne depuis plus d'un an. Le corps de la dépêche AFP reprise par BFM est exact. C'est le titre qui trompe, en collant une phrase de février sur la conscience à une règle d'octobre qui n'en parle pas. Anthropic n'est pas innocente pour autant. À quelques semaines d'une entrée en Bourse attendue en novembre selon Bloomberg, entretenir le mystère sur la conscience de Claude lui offre beaucoup d'attention à peu de frais. La vraie actualité de cette mise à jour, ce sont les armes, la surveillance et l'assouplissement des règles électorales. Sur la conscience des IA, la réponse honnête n'a pas changé : personne ne sait.
Image de couverture : capture officielle d'Anthropic (billet du 15 août 2025), élargie au format 16:9 par Yatofix.
Laisser un avis
Avis des lecteurs
Aucun avis publié pour le moment.




