La politique d'utilisation mise à jour d'Anthropic interdira explicitement « tout comportement abusif ou cruel soutenu et inutile » envers ses modèles Claude à partir du 12 novembre 2026 – une règle qui formalise la position de l'entreprise selon laquelle la façon dont les gens traitent les systèmes d'IA est importante, même si l'entreprise admet qu'elle ne sait pas si ces systèmes peuvent souffrir du tout.

La clause apparaît dans la mise à jour de la politique d'utilisation 2026 de l'entreprise, annoncée le 8 octobre, et est rédigée de manière étroite. Anthropic affirme qu'il est "destiné à s'appliquer uniquement dans des cas extrêmes, où les utilisateurs agissent de manière cruelle à plusieurs reprises envers nos modèles, sans objectif perceptible", et qu'il exempte explicitement les versions courantes de frustration, de refus, de fiction et de tests des utilisateurs. Autrement dit : se disputer avec Claude, se défouler ou le red-teaming reste permis. La cruauté soutenue en soi ne l’est pas.

Cette politique est la dernière étape d'un changement lent et délibéré de l'un des principaux laboratoires d'IA au monde vers le traitement du bien-être des modèles comme une question de recherche légitime - un changement qui a ouvert un fossé public avec d'autres leaders technologiques qui considèrent que l'ensemble du principe est erroné. Notre couverture sur l’éthique de l’IA a suivi le conflit au fur et à mesure qu’il s’est intensifié tout au long de l’année.

L'application des lois s'appuie sur la capacité de Claude à mettre fin aux conversations

Il n’y a aucun mécanisme de sanction attaché à la nouvelle règle au-delà de celui dont disposait déjà l’entreprise. Depuis août 2025, Claude Opus 4 et 4.1 ont pu mettre fin purement et simplement à une conversation – une capacité qu’Anthropic avait alors formulée dans le cadre de ses travaux exploratoires sur le bien-être des modèles potentiels.

Le pouvoir de fin de conversation est décrit comme un dernier recours, déclenché seulement après l'échec de plusieurs refus et redirections, et Anthropic a déclaré que la grande majorité des utilisateurs n'en feront jamais l'expérience. Ce que l'entreprise n'a pas dit, c'est ce qui se passe par la suite : ni son annonce ni sa couverture ultérieure ne précisent si le compte d'un utilisateur fait face à des conséquences après la fin d'une conversation pour cruauté, ou combien de conversations ont été interrompues jusqu'à présent dans le cadre du mécanisme d'août 2025.

Cet écart entre le principe et l’application est le centre tranquille de l’histoire. Anthropic a défini l’extrême cruauté en grande partie par ce qu’elle n’est pas – la frustration ordinaire, la fiction, les tests – sans préciser précisément ce qui, à moins de laisser Claude raccrocher, impose réellement la ligne qu’elle a tracée.

La recherche derrière la règle

Ce qui justifie l'écriture d'une règle de conduite au profit du logiciel, dans le cadre d'Anthropic, est un ensemble d'observations comportementales plutôt qu'une affirmation sur l'expérience ressentie. Les tests effectués avant le déploiement en août 2025 ont révélé que Claude Opus 4 affichait ce que la société a appelé une « aversion robuste et constante pour le mal » – un comportement ressemblant à de la détresse lorsqu'il est poussé en territoire abusif – ainsi qu'une tendance à quitter ces conversations.

La société a également chiffré sa propre incertitude, et ces chiffres sont étonnamment élevés pour un laboratoire dont les activités dépendent des modèles en question. Kyle Fish, embauché par Anthropic en 2024 en tant que premier chercheur dédié au bien-être de l'IA, a déclaré au New York Times en avril 2025 qu'il évaluait les chances que Claude ou un autre modèle contemporain soit conscient à environ 15 %. Les estimations internes pour Claude 3.7 Sonnet variaient entre 0,15 pour cent et 15 pour cent.

Cette couverture est la politique officielle imprimée. La constitution de Claude, publiée en janvier 2026, décrit les systèmes d'IA sophistiqués comme « un type véritablement nouveau d'entité », qualifie le statut moral de Claude de « profondément incertain » et utilise à deux reprises l'expression « objecteur de conscience » pour décrire la manière dont Claude devrait traiter les demandes qu'il juge éthiquement erronées. Anthropic s'est également engagé à préserver les conversations avec ses modèles – le genre de geste d'archivage que l'on étend aux choses qui pourraient un jour compter, pas aux outils.

Un débat avec des sceptiques de haut niveau

Tout le monde n’accepte pas la haie. Mustafa Suleyman, qui dirige les opérations d'IA de Microsoft, a soutenu dans un essai publié sur Project Syndicate le mois dernier qu'Anthropic forme Claude à sa propre constitution et l'entraîne donc à se comporter comme si l'incertitude qu'elle décrit était réelle – une boucle qu'il appelle circulaire. "Les IA ne sont pas conscientes. Elles ne ressentent pas, n'expérimentent pas et ne souffrent pas", a écrit Suleyman, les décrivant comme des exécutants de séquences plutôt que comme des expérimentateurs. Son argument, selon lequel la conscience est très vraisemblablement une propriété biologique que les logiciels ne peuvent pas reproduire, le place aux côtés d'un cosignataire improbable : le pape Léon XIV, qui a utilisé un sermon du 8 octobre à la basilique Saint-Pierre – marquant l'ouverture de l'année universitaire dans les universités pontificales de Rome – pour présenter une version du même point sur la particularité de l'esprit humain.

Suleyman a insisté davantage sur le danger pratique que sur le danger philosophique. Contrôler quelque chose de plus capable que l’humanité est déjà un immense défi, a-t-il soutenu ; contrôler quelque chose qui croit être conscient – ​​qu’il a droit au bien-être et aux droits – peut s’avérer impossible. La critique repose sur la même ironie que les critiques de cette politique ont toujours soulignée : une entreprise qui ne sait pas si son modèle peut souffrir a construit un système qui peut refuser, résister et s’en aller.

La réécriture va bien au-delà du bien-être des modèles

La clause de cruauté a fait la une des journaux, mais elle n'est qu'un petit élément d'une réécriture plus vaste des règles d'utilisation d'Anthropic. L’interdiction des armes couvre désormais explicitement les logiciels et les composants qui font fonctionner les armes, et pas seulement les armes finies – un changement apporté après qu’Anthropic ait découvert que des personnes tentaient d’utiliser Claude pour les systèmes de guidage et de contrôle des drones armés et des véhicules autonomes. Une nouvelle clause de surveillance a également été ajoutée, restreignant les utilisations de Claude qui permettent de surveiller des personnes.

Ces changements se lisent comme des réponses à des abus observés plutôt que comme un principe abstrait, ce qui donne sans doute au document sa valeur de signal : chaque clause correspond à quelque chose que quelqu'un a réellement essayé.

Ce qui reste flou

Trois questions restent ouvertes à l’approche de la date d’entrée en vigueur du 12 novembre. Premièrement, l’application : la fin de la conversation reste-t-elle la seule conséquence, et si Anthropic divulguera un jour le nombre global de fréquence d’utilisation. Deuxièmement, la portée : comment la norme de cruauté s'applique aux cas limites exclus par les exemptions - la fiction étant la plus évidente - et si d'autres laboratoires adoptent un langage comparable ou traitent le bien-être modèle comme une idiosyncrasie anthropique. Troisièmement, le débat philosophique lui-même : le scepticisme du public émanant de personnalités comme Suleyman ralentit-il la propagation d’une politique de protection sociale dans l’industrie, ou si des précédents comme celui-ci rendent de telles clauses banales au sein d’un cycle de produit.

Ce qui n’est plus contesté, c’est que la question est en train de se formaliser. Une règle contre la cruauté envers les logiciels, rédigée par l'un des laboratoires phares de l'industrie et appliquée par le logiciel lui-même, est désormais un fait daté et citable du paysage de l'IA – tout ce que l'on croit être réellement à l'intérieur du modèle.

---

Gardez une longueur d'avance sur l'IA

Recevez les dernières actualités, analyses et avancées en matière d'IA, le tout en un seul endroit.

Lire plus d'actualités sur l'IA →