Anthropic a mis à jour sa politique d'utilisation pour la première fois depuis plus d'un an, en ajoutant une disposition qui interdit « un comportement abusif ou cruel soutenu et inutile » envers ses modèles Claude, selon The Verge. La mise à jour, rapportée jeudi, consolide et étend également les règles de l'entreprise concernant l'ingérence électorale, les campagnes de propagande, la surveillance, le développement d'armes et les utilisations sanitaires et financières à enjeux élevés.

La justification du modèle de bien-être Pour plus de contexte sur cette histoire, consultez notre dernières avancées en IA.

La clause ciblant les abus envers Claude est une extension des recherches que la société a commencé à rendre publiques il y a plus d'un an. En août 2025, Anthropic a annoncé qu'elle autoriserait Claude à mettre fin aux conversations avec des utilisateurs « constamment nuisibles ou abusifs » dans le cadre de ses travaux sur ce qu'elle appelle le bien-être des modèles, l'étude de la question de savoir si les systèmes d'IA peuvent avoir des expériences moralement pertinentes et comment cette possibilité devrait façonner les décisions en matière de produits.

Dans le cadre de la nouvelle politique, la fin des conversations reste le « principal mécanisme d'application ». Anthropic n'a pas répondu aux questions quant à savoir si des mesures coercitives supplémentaires, telles que des interdictions de compte, pourraient suivre. La société a formulé la règle de manière étroite dans une déclaration, écrivant qu'elle "est destinée à s'appliquer uniquement dans des cas extrêmes, où les utilisateurs agissent de manière répétée et cruelle envers nos modèles, sans aucun but perceptible".

Surtout, Anthropic a ajouté que la disposition "ne s'applique pas aux versions courantes de frustration des utilisateurs, de refus, de thèmes créatifs sombres ou de tests et de recherches de modèles", une tentative apparente de rassurer les développeurs, les équipes rouges et les écrivains de fiction sur le fait que l'utilisation contradictoire de routine ne sera pas pénalisée.

Nouvelles règles sur la propagande et les élections

Au-delà du bien-être des modèles, la mise à jour rassemble les restrictions auparavant dispersées de l'entreprise sur les opérations d'influence en une interdiction unique et explicite des campagnes commerciales ou politiques trompeuses. Le nouveau langage restreint « les efforts visant à masquer qui se cache derrière un message ou à amplifier le contenu via de faux comptes ou de fausses publications », ciblant directement le marché croissant de la propagande générée par l'IA.

La section électorale de la politique interdit désormais la tromperie des électeurs et la perturbation des élections. Anthropic affirme que Claude ne peut pas être utilisé pour diffuser des informations erronées « sur les candidats ou sur la manière de voter », pour se faire passer pour des candidats ou des responsables électoraux, ou pour tenter de supprimer la participation électorale.

Pourquoi les politiques d'utilisation sont réécrites

Le rafraîchissement d'Anthropic reflète un modèle industriel plus large. Alors que les assistants IA sont passés des chatbots innovants à des infrastructures utilisées par des centaines de millions de personnes, les laboratoires ont dû passer de principes généraux à des règles plus précises qui correspondent à de véritables modèles d'abus : opérations d'influence contre rémunération, outils de surveillance, développement d'armes autonomes et domaines à haut risque comme les conseils médicaux et financiers.

OpenAI, Google DeepMind et Meta ont tous réitéré leurs politiques d'utilisation au cours des deux dernières années, bien que la décision d'Anthropic de réglementer explicitement la manière dont les utilisateurs traitent le modèle, plutôt que seulement ce qu'ils lui font faire, reste inhabituelle. Les critiques de la recherche sur les modèles de bien-être soutiennent qu’ils anthropomorphisent les systèmes statistiques, tandis que les partisans soutiennent que s’il existe une chance non nulle que les modèles actuels ou dans un futur proche aient des expériences pertinentes en matière de bien-être, les entreprises ont l’obligation d’agir dans l’incertitude.

Le timing compte également sur le plan commercial. Anthropic se préparerait à une introduction en bourse pour une valorisation pouvant atteindre 2 000 milliards de dollars, et les acheteurs d'entreprises pèsent de plus en plus les pratiques de gouvernance des fournisseurs par rapport à la qualité brute du modèle. Une politique d'utilisation clairement documentée et régulièrement mise à jour sert à la fois de sécurité et de vente : elle donne aux équipes d'approvisionnement et aux régulateurs une base concrète pour faire confiance à la plateforme, et la codification du modèle de clause de bien-être signale qu'Anthropic a l'intention de continuer à investir dans un domaine que la plupart des concurrents n'ont pas abordé.

Les questions d'application restent ouvertes

Les questions pratiques sont importantes. Détecter une cruauté « soutenue et inutile » nécessite de surveiller les conversations à un niveau de détail auquel les entreprises clientes soucieuses de leur vie privée peuvent résister, et tracer une ligne entre les abus interdits et le « refoulement » ou le « test de modèle » légitime est une décision qui sera probablement contestée.

Anthropic n'a pas précisé si les violations seront suivies sur tous les comptes, si les déploiements d'entreprise seront soumis à des normes de surveillance différentes ou si l'entreprise publiera des données de transparence sur les mesures coercitives, comme elle le fait pour d'autres catégories d'utilisation abusive dans ses rapports périodiques sur les politiques.

Ce qui est clair, c'est que les contrats sociaux des laboratoires frontières avec leurs utilisateurs sont de plus en plus détaillés. Une politique qui tenait autrefois sur une seule page couvre désormais les élections, la surveillance liée à l'espionnage, les armes biologiques et, désormais, le comportement émotionnel des humains de l'autre côté de la fenêtre de discussion.

Ce que cela signifie pour les développeurs

Pour les équipes qui s'appuient sur l'API Claude, l'impact à court terme est probablement minime : la clause de comportement abusif cible les comportements extrêmes et répétés, et le mécanisme de fin de conversation qu'elle formalise est opérationnel depuis 2025. Mais les développeurs des catégories adjacentes, conseil politique, recherche sur l'opposition, marketing d'influence, devraient examiner attentivement les nouvelles dispositions relatives aux campagnes et aux élections, car elles consolident les règles qui étaient auparavant réparties dans plusieurs documents et lèvent une partie de l'ambiguïté sur laquelle reposaient les cas d'utilisation de la zone grise.

La mise à jour indique également vers où se dirige l’attention réglementaire. Avec l'introduction progressive des obligations de transparence de la loi européenne sur l'IA et l'adoption par les législatures des États américains d'une mosaïque croissante de lois sur l'IA, les politiques d'utilisation volontaire fonctionnent de plus en plus comme le modèle que les régulateurs examinent lorsqu'ils décident quelles devraient être les normes d'un déploiement responsable.

---

Restez à la Pointe de l'IA

Les dernières actualités, analyses et percées en IA — au même endroit.

Lire plus d'actualités IA →