Quelques jours après qu'Anthropic a commencé à déployer des filigranes invisibles sur les sorties texte et image de Claude, la fonctionnalité génère exactement le genre de frictions que les critiques avaient prédit : les utilisateurs craignaient que les marques ne les exposent à l'utilisation de l'IA au travail ou en classe, les développeurs documentaient le comportement du filigrane dans de véritables flux de travail de codage et un marché restreint mais visible d'outils promettant de le supprimer.

Anthropic affirme que ce changement met Claude en conformité avec la loi sur l'IA de l'Union européenne, dont les règles de transparence sont devenues applicables pour les nouveaux modèles après le 2 août 2026. L'article 50 de la loi exige que les fournisseurs de systèmes d'IA rendent la sortie générée par la machine « détectable comme générée artificiellement ». Anthropic a confirmé que tous les nouveaux modèles proposés dans le monde – et pas seulement dans l'UE – marqueront le contenu généré par l'IA « dès le premier jour », avec une période de grâce jusqu'en décembre 2026 pour la mise à jour des modèles précédemment publiés. Pour plus de contexte sur cette histoire, consultez notre tendances IA.

Les marques elles-mêmes sont invisibles. Les sorties texte « portent des filigranes intégrés », tandis que les fichiers générés incluent des métadonnées de provenance signées numériquement là où le format le prend en charge, selon un article d'assistance d'Anthropic. Les modèles Claude antérieurs seront également mis à jour pour marquer le texte, ce qui signifie que l'ensemble de la flotte finira par tamponner sa production.

Le filigrane couvre le texte modifié, pas seulement le texte généré

Le détail qui a transformé la curiosité technique en réaction négative a été révélé par Ars Technica le 13 août : le filigrane s'applique au contenu que Claude traite, et pas seulement au contenu qu'il génère à partir de zéro. Ars a qualifié l'approche de « le lancer depuis l'orbite », car Anthropic marque tout le contenu traité là où il est pris en charge, même si les propres directives de l'UE ne l'exigent pas lorsqu'un système d'IA remplit « une fonction d'assistance pour l'édition standard » – l'exemple du règlement est la correction grammaticale – ou lorsqu'il ne « modifie pas substantiellement » le texte d'un utilisateur.

Cette distinction est importante car un filigrane appliqué au niveau du modèle ne peut pas distinguer la génération globale d'une correction par virgule. Ashley Belanger d'Ars Technica a noté que Claude pourrait finir par tamponner exactement le genre d'écriture humaine légèrement retouchée que la loi a été écrite pour laisser tranquille. En pratique, la marque signale tout ce que Claude a traité – même un document qu'un humain a écrit et qu'il a seulement demandé à Claude de peaufiner.

Les utilisateurs craignent d'être surpris au travail et à l'école

La réaction des utilisateurs a été rapide. TechCrunch a rapporté le 13 août que certains utilisateurs de Claude "sont furieux que les nouveaux filigranes d'Anthropic les surprennent à l'utiliser au travail ou en cours". Les employés qui s'appuient discrètement sur Claude pour rédiger des e-mails, des rapports ou des diapositives - et les étudiants qui l'utilisent pour leurs devoirs - sont désormais confrontés à la possibilité qu'un patron ou un instructeur puisse vérifier l'implication de l'IA avec un outil de détection.

Ars Technica a décrit la dynamique comme une « lettre écarlate » – un badge invisible d'utilisation de l'IA que le lecteur ne peut pas voir, mais que les institutions pourraient bientôt voir. Étant donné que le filigrane se déplace avec le texte via les copier-coller et les changements de format, la défense habituelle du « Je viens de le modifier un peu » ne laisse plus les empreintes digitales de l'IA derrière elle.

Un marché du déménagement est déjà en train d'émerger

Là où il y a un filigrane, une industrie de suppression suit. SC Media a rapporté qu'un marché pour les outils de suppression de filigranes IA est déjà en train d'émerger dans les jours qui ont suivi la mise à jour de Claude. Decrypt a documenté que les constructeurs tentent activement de briser le système de marquage, en examinant son comportement lors de la paraphrase, de la traduction et du reformatage.

Les premiers tests suggèrent que le filigrane est résistant aux manipulations occasionnelles, mais qu'il fuit dans des conditions professionnelles. La couverture de New Stack concluait que la marque « survit au copier-coller, mais pas au véritable flux de travail de développement » – ce qui signifie que les développeurs de logiciels qui retravaillent considérablement le code suggéré par l'IA dans le cadre de l'ingénierie normale peuvent effacer la marque sans jamais le vouloir.

Comment fonctionne réellement la marque

Un explicatif visuel largement partagé publié sur declaude.org décompose le mécanisme. Le texte n'a pas de pixels dans lesquels cacher les données et aucune métadonnée ne survit au copier-coller, donc le filigrane vit dans « les choix entre les mots ». Comme l’écrit un modèle, il sélectionne à plusieurs reprises parmi plusieurs mots suivants également plausibles ; une clé cryptographique secrète oriente discrètement ces sélections vers un modèle que seul le détenteur de la clé peut détecter.

La technique remonte aux recherches de Kirchenbauer et al. à partir de 2023, qui a divisé les mots candidats en listes « vertes » et « rouges » et a orienté la génération vers les jetons verts. Le SynthID de Google atteint une destination similaire par un chemin plus subtil, et Google filigrane le texte de l'application Gemini et de l'expérience Web depuis 2024 – son API est une exception documentée. Depuis août 2026, les nouveaux modèles Claude marquent le texte au niveau du modèle, et les modèles précédents devraient suivre.

Les sceptiques disent que la suppression reste triviale

Tout le monde n’est pas convaincu que la course aux armements favorise l’Anthropie. Dans un essai largement diffusé, l'ingénieur Sean Goedecke a soutenu que les filigranes de texte "seront toujours faciles à supprimer" car le texte est un support extrêmement compressé - tout changement suffisamment important pour survivre à une suppression déterminée est un changement qu'un lecteur humain remarquerait. Les outils de paraphrase, les allers-retours de traduction et la reformulation délibérée menacent tous d’effacer les modèles statistiques sans dégrader le sens.

Le débat se déroule dans les communautés de développeurs : deux explications distinctes du filigrane se sont classées parmi les articles les plus discutés sur Hacker News cette semaine, attirant des centaines de points d'engagement entre eux.

Que se passe-t-il ensuite

Anthropic a déclaré qu'elle partagerait éventuellement des détails sur la façon de détecter les marques – le soutien technique requis par la réglementation européenne – mais jusqu'à ce qu'un outil de détection public soit livré, les parties extérieures ne peuvent pas vérifier le degré de précision du marquage. La société a également reconnu que les filigranes ne fonctionneraient pas sur « certaines plates-formes ou fonctionnalités » qui ne les prennent pas en charge.

Alors que les anciens modèles sont confrontés à une date limite de conformité en décembre 2026 et que les laboratoires rivaux surveillent si les utilisateurs punissent Anthropic pour sa transparence, les prochains mois testeront une proposition que l'industrie a évitée pendant des années : si les fournisseurs d'IA peuvent rendre leurs résultats traçables sans les rendre toxiques pour les personnes qui en dépendent.

---

Restez à la Pointe de l'IA

Les dernières actualités, analyses et percées en IA — au même endroit.

Lire plus d'actualités IA →