OpenAI kondigde op 5 oktober aan dat het onzichtbare watermerken gaat toevoegen aan tekst gegenereerd door ChatGPT en Codex voor gebruikers in de Europese Unie, een concreet antwoord op de regels voor de herkomst van tekst in de EU AI Act. In een blogpost met de titel ‘Onze benadering van de EU-regels voor de herkomst van tekst’ zei het bedrijf dat de watermerken ‘in de komende weken’ zullen worden uitgerold voor in aanmerking komende output in het blok, een plan dat dezelfde dag werd gerapporteerd door TechCrunch, The Verge, BleepingComputer, Engadget en andere verkooppunten.
De technologie achter de verandering heet textGrain. In plaats van een zichtbare markering in te sluiten, werkt textGrain door op subtiele wijze de woordkeuzes van het model te sturen, zodat de resulterende tekst een statistisch patroon draagt dat later kan worden gedetecteerd. Lezers zullen niets merken bij het consumeren of kopiëren van door AI gegenereerde tekst; detectie vereist toegang tot de detector van OpenAI, die niet beschikbaar is voor het grote publiek. Voor een bredere kijk op de manier waarop toezichthouders en laboratoria met elkaar botsen over AI-regels, volgt u onze voortdurende dekking van het AI-beleid.
Hoe textGrain-watermerken werken
De aanpak van OpenAI wijzigt het tokenselectieproces tijdens het genereren. Het bedrijf zegt dat textGrain "de woordkeuzes van het model enigszins verandert om een statistisch patroon te creëren dat later kan worden gedetecteerd", aldus rapportage door BleepingComputer. Het watermerk is onzichtbaar wanneer de tekst wordt gelezen of gekopieerd, en OpenAI beweert dat het de uitvoerkwaliteit niet verslechtert.
De detectiekant is bewust beperkt. Naast de watermerklancering opent OpenAI toepassingen voor zijn watermerkdetector, maar de toegang zal in eerste instantie beperkt zijn tot goedgekeurde onderzoekers en deskundige organisaties. Dat ontwerp zorgt ervoor dat de detectiecapaciteit buiten de handen blijft van iedereen die deze wil bewapenen, maar het betekent ook dat uitgevers, docenten en werkgevers niet onafhankelijk kunnen verifiëren of een stuk tekst een watermerk heeft.
API-toegang is wereldwijd mogelijk
Het EU-mandaat is van toepassing op ChatGPT- en Codex-uitvoer in het blok, maar OpenAI geeft ontwikkelaars overal ter wereld tegelijkertijd een keuze. Vanaf 5 oktober kunnen API-ontwikkelaars wereldwijd zich aanmelden voor tekstwatermerken voor ondersteunde modellen. De functie blijft standaard uitgeschakeld op de API, een beslissing die The New Stack benadrukte als een contrast met de aanpak van Anthropic, die eerder dit jaar herkomstmarkering aanzette voor EU-verkeer in zijn eigen reactie op dezelfde regels.
Deze opt-in-houding zal ontwikkelaars geruststellen die zich zorgen maken over onvoorziene bijwerkingen. Statistische watermerken veranderen de manier waarop tokens worden bemonsterd, en elke wijziging in de generatie brengt op zijn minst een theoretisch risico met zich mee dat het gedrag in randgevallen verandert. Door van watermerken een vlag te maken in plaats van een standaard, draagt OpenAI de nalevingsbeslissing over aan de bedrijven die voortbouwen op zijn modellen.
Waarom de EU AI-wet dit afdwong
De transparantiebepalingen van de EU AI Act vereisen dat door AI gegenereerde tekst identificeerbaar is als door een machine gegenereerde tekst, een verplichting die zowel OpenAI als Anthropic ertoe heeft aangezet om statistische watermerken te gebruiken. In de blogpost van OpenAI wordt textGrain geframed als de implementatie van deze herkomstvereisten, en PYMNTS rapporteerde de uitrol omdat OpenAI rechtstreeks voldoet aan de "EU AI Act-mandaten".
De timing is opmerkelijk. De aankondiging van het watermerk komt terecht in een ongewoon turbulente periode voor de publieke houding van OpenAI: dezelfde nieuwscyclus bracht het vertrek van veiligheidsleider David Robinson met zich mee, een FTC-onderzoek naar consumentenrisico's bij grote AI-laboratoria, en een sfeer van rechtszaken voor aandeelhouders die het bedrijf onder de loep heeft gehouden. Watermerken is een van de weinige wettelijke eisen die OpenAI volledig kan vervullen met infrastructuur in plaats van met productwijzigingen, wat zou kunnen verklaren waarom het als eerste werd uitgebracht.
Het addertje onder het gras: watermerken breken tijdens bewerken
OpenAI zelf geeft de fundamentele beperking toe. Het bedrijf geeft toe dat het watermerk kan verdwijnen als de tekst wordt geredigeerd, en decennia van onderzoek naar taalkundige steganografie onderschrijven deze zorg: parafraseren, vertalen of zelfs bescheiden herschrijven kan statistische watermerken vernietigen. Iedereen die vastbesloten is om AI-tekst wit te wassen via een ‘humanizer’-tool zal waarschijnlijk daarin slagen.
Deze zwakte heeft toezichthouders er niet van weerhouden watermerken te eisen, en het heeft laboratoria er ook niet van weerhouden watermerken te verzenden. Het realistische doel is niet het fraudebestendig maken van de herkomst, maar het verhogen van de kosten van toevallige misleiding op grote schaal, dezelfde logica die ten grondslag ligt aan valutawatermerken. Critici, waaronder enkele AI-veiligheidsgroepen die sceptisch stonden tegenover vrijwillige maatregelen van de industrie, beweren dat detectoren die alleen toegankelijk zijn voor goedgekeurde organisaties weinig betekenen voor leraren, redacteuren of platforms die proberen hun eigen AI-inhoudsbeleid af te dwingen.
Wat het betekent voor gebruikers en ontwikkelaars
Voor ChatGPT- en Codex-gebruikers binnen de EU zal er zichtbaar niets veranderen. Tekst ziet er hetzelfde uit en voelt hetzelfde, en er verschijnt geen label op de uitvoer. Het watermerk zal er gewoon zijn en in principe detecteerbaar zijn door de goedgekeurde partners van OpenAI.
Voor ontwikkelaars arriveert de API-vlag onmiddellijk en is het de moeite waard om zorgvuldig te evalueren: het inschakelen ervan betekent het accepteren van subtiele wijzigingen in token-sampling bij elke voltooiing, zelfs voor niet-EU-gebruikers, aangezien de API-instelling mondiaal is. Teams met strikte latentie- of kwaliteitsbudgetten willen wellicht het genereren van watermerken vergelijken met hun huidige configuratie voordat ze de schakelaar omzetten.
OpenAI zegt meer details over in aanmerking komende modellen en het detectoraanvraagproces zal de komende weken plaatsvinden. Omdat andere laboratoria met dezelfde EU-verplichtingen worden geconfronteerd, is het onwaarschijnlijk dat textGrain het laatste watermerkprogramma zal zijn dat de industrie dit jaar implementeert.
Blijf AI een stap voor
Regelgeving verandert de manier waarop AI-producten onder de motorkap werken. Ontvang de laatste AI-ontwikkelingen op AI Buzz Wire, waarbij beleidsanalyses en modelnieuws de hele dag worden bijgewerkt.
Lees hier meer AI-nieuws.