OpenAI a annoncé le 5 octobre qu'elle commencerait à ajouter des filigranes invisibles au texte généré par ChatGPT et Codex pour les utilisateurs de l'Union européenne, sa réponse concrète aux règles de provenance du texte de la loi européenne sur l'IA. Dans un article de blog intitulé "Notre approche des règles de provenance des textes de l'UE", la société a déclaré que le filigrane serait déployé "au cours des prochaines semaines" pour les productions éligibles dans le bloc, un plan rapporté le même jour par TechCrunch, The Verge, BleepingComputer, Engadget et d'autres médias.
La technologie derrière ce changement s’appelle textGrain. Plutôt que d'intégrer une marque visible, textGrain fonctionne en orientant subtilement les choix de mots du modèle afin que le texte résultant comporte un modèle statistique pouvant être détecté ultérieurement. Les lecteurs ne remarqueront rien lorsqu’ils consomment ou copient du texte généré par l’IA ; la détection nécessite l'accès au détecteur d'OpenAI, qui n'est pas accessible au grand public. Pour un aperçu plus large de la manière dont les régulateurs et les laboratoires s’affrontent sur les règles de l’IA, suivez notre couverture politique en matière d’IA.
Comment fonctionne le filigrane textGrain
L'approche d'OpenAI modifie le processus de sélection des jetons lors de la génération. La société affirme que textGrain "modifie légèrement les choix de mots du modèle pour créer un modèle statistique qui peut être détecté ultérieurement", selon un rapport de BleepingComputer. Le filigrane est invisible lorsque le texte est lu ou copié, et OpenAI affirme qu'il ne dégrade pas la qualité de sortie.
Le côté détection est volontairement restreint. Parallèlement au lancement du filigrane, OpenAI ouvre des applications pour son détecteur de filigrane, mais l'accès sera initialement limité aux chercheurs agréés et aux organisations expertes. Cette conception maintient la capacité de détection hors de portée de quiconque espère la transformer en arme, mais cela signifie également que les éditeurs, les enseignants et les employeurs ne peuvent pas vérifier de manière indépendante si un morceau de texte est filigrané.
L'accès à l'API est opt-in dans le monde entier
Le mandat de l'UE s'applique aux résultats ChatGPT et Codex dans le bloc, mais OpenAI donne simultanément le choix aux développeurs du monde entier. À partir du 5 octobre, les développeurs d'API du monde entier peuvent activer le filigrane de texte pour les modèles pris en charge. La fonctionnalité reste désactivée par défaut sur l'API, une décision soulignée par The New Stack qui contraste avec l'approche d'Anthropic, qui a activé le marquage de provenance pour le trafic de l'UE plus tôt cette année, dans sa propre réponse aux mêmes règles.
Cette posture d’adhésion rassurera les développeurs inquiets des effets secondaires imprévus. Le tatouage statistique modifie la façon dont les jetons sont échantillonnés, et toute modification de la génération comporte au moins un risque théorique de changement de comportement dans les cas extrêmes. En faisant du filigrane un indicateur plutôt qu'un défaut, OpenAI transfère la décision de conformité aux entreprises qui s'appuient sur ses modèles.
Pourquoi la loi européenne sur l'IA a imposé cela
Les dispositions de transparence de la loi européenne sur l'IA exigent que le texte généré par l'IA soit identifiable comme étant généré par une machine, une obligation qui a poussé OpenAI et Anthropic vers des systèmes de filigrane statistique. Le billet de blog d'OpenAI présente textGrain comme sa mise en œuvre de ces exigences de provenance, et PYMNTS a signalé le déploiement comme OpenAI répondant directement aux « mandats de l'EU AI Act ».
Le timing est remarquable. L'annonce du filigrane intervient au milieu d'une période inhabituellement turbulente pour la position publique d'OpenAI : le même cycle d'actualités a entraîné le départ du responsable de la sécurité David Robinson, une enquête de la FTC sur les risques pour les consommateurs dans les principaux laboratoires d'IA et une atmosphère de procès entre actionnaires qui a maintenu l'entreprise sous surveillance. Le filigrane est l'une des rares exigences réglementaires qu'OpenAI peut satisfaire pleinement avec des modifications d'infrastructure plutôt que de produits, ce qui peut expliquer pourquoi il a été livré en premier.
The Catch : les filigranes se cassent en cours d'édition
OpenAI lui-même concède la limitation fondamentale. L'entreprise admet que son filigrane peut disparaître lorsque le texte est édité, et des décennies de recherche sur la stéganographie linguistique confortent cette préoccupation : la paraphrase, la traduction ou même une modeste réécriture peuvent détruire les filigranes statistiques. Quiconque est déterminé à blanchir du texte IA grâce à un outil « humaniseur » réussira probablement.
Cette faiblesse n’a pas empêché les régulateurs d’exiger le filigrane, ni les laboratoires de l’expédier. L’objectif réaliste n’est pas d’obtenir une provenance infalsifiable mais d’augmenter à grande échelle le coût d’une tromperie occasionnelle, la même logique qui régit les filigranes monétaires. Les critiques, y compris certains groupes de sécurité de l'IA qui se sont montrés sceptiques quant aux mesures volontaires de l'industrie, affirment que les détecteurs accessibles uniquement aux organisations agréées ne font pas grand-chose pour les enseignants, les éditeurs ou les plateformes qui tentent d'appliquer leurs propres politiques en matière de contenu d'IA.
Ce que cela signifie pour les utilisateurs et les développeurs
Pour les utilisateurs de ChatGPT et du Codex au sein de l’UE, rien ne changera visiblement. Le texte aura la même apparence et aucune étiquette n’apparaîtra sur les sorties. Le filigrane sera simplement là, détectable en principe par les partenaires agréés d'OpenAI.
Pour les développeurs, l'indicateur API arrive immédiatement et mérite d'être évalué avec soin : l'activer signifie accepter des modifications subtiles de l'échantillonnage des jetons à chaque achèvement, même pour les utilisateurs non européens, puisque le paramètre API est global. Les équipes disposant de budgets de latence ou de qualité stricts voudront peut-être comparer la génération de filigranes à leur configuration actuelle avant d'appuyer sur le bouton.
OpenAI indique que plus de détails sur les modèles éligibles et le processus de demande de détecteur arriveront dans les semaines à venir. Comme d’autres laboratoires sont confrontés aux mêmes obligations européennes, il est peu probable que textGrain soit le dernier système de filigrane déployé par l’industrie cette année.
Gardez une longueur d'avance sur l'IA
La réglementation remodèle la façon dont les produits d’IA fonctionnent sous le capot. Obtenez les derniers développements en matière d'IA sur AI Buzz Wire, avec des analyses politiques et des actualités sur les modèles mises à jour tout au long de la journée.
Lisez plus d'actualités sur l'IA ici.