OpenAI meddelade den 5 oktober att de kommer att börja lägga till osynliga vattenstämplar till text som genereras av ChatGPT och Codex för användare i Europeiska Unionen, dess konkreta svar på EU:s AI-lags härkomstregler för text. I ett blogginlägg med titeln "Vårt tillvägagångssätt för EU-text härkomstregler", sa företaget att vattenmärkningen kommer att rullas ut "under de kommande veckorna" för kvalificerad produktion i blocket, en plan som rapporterades samma dag av TechCrunch, The Verge, BleepingComputer, Engadget och andra butiker.
Tekniken bakom förändringen kallas textGrain. Istället för att bädda in ett synligt märke, fungerar textGrain genom att subtilt styra modellens ordval så att den resulterande texten bär ett statistiskt mönster som kan upptäckas senare. Läsare kommer inte att märka något när de konsumerar eller kopierar AI-genererad text; detektering kräver tillgång till OpenAI:s detektor, som inte är tillgänglig för allmänheten. För en bredare titt på hur tillsynsmyndigheter och labb kolliderar över AI-regler, följ vår pågående AI-policy.
Hur textGrain Watermarking fungerar
OpenAI:s tillvägagångssätt ändrar tokenvalsprocessen under generering. Företaget säger att textGrain "något ändrar modellens ordval för att skapa ett statistiskt mönster som senare kan upptäckas", enligt rapportering från BleepingComputer. Vattenstämpeln är osynlig när texten läses eller kopieras, och OpenAI hävdar att den inte försämrar utskriftskvaliteten.
Detektionssidan är medvetet begränsad. Parallellt med lanseringen av vattenstämpeln öppnar OpenAI applikationer för sin vattenmärkesdetektor, men tillgången kommer initialt att vara begränsad till godkända forskare och expertorganisationer. Den designen håller identifieringsförmågan borta från händerna på alla som hoppas kunna beväpna den, men det betyder också att utgivare, lärare och arbetsgivare inte självständigt kan verifiera om en text är vattenstämplad.
API-åtkomst är opt-in över hela världen
EU-mandatet gäller ChatGPT och Codex-utdata i blocket, men OpenAI ger samtidigt utvecklare överallt ett val. Från och med den 5 oktober kan API-utvecklare över hela världen välja att använda textvattenmärkning för modeller som stöds. Funktionen förblir inaktiverad som standard på API:t, ett beslut som The New Stack lyfte fram som en kontrast till Anthropics tillvägagångssätt, som aktiverade härkomstmärkning för EU-trafik tidigare i år i sitt eget svar på samma regler.
Denna opt-in-hållning kommer att lugna utvecklare som är oroliga för oförutsedda biverkningar. Statistisk vattenmärkning ändrar hur tokens samplas, och varje modifiering av generationen medför åtminstone en teoretisk risk för förändrat beteende på kantfall. Genom att göra vattenmärkning till en flagga snarare än en standard, överför OpenAI överensstämmelsebeslutet till företag som bygger på dess modeller.
Varför EU:s AI-lag tvingade fram detta
EU:s AI-lags bestämmelser om insyn kräver att AI-genererad text ska kunna identifieras som maskingenererad, en skyldighet som drivit både OpenAI och Anthropic mot statistiska vattenmärkningssystem. OpenAIs blogginlägg ramar textGrain som dess implementering av dessa härkomstkrav, och PYMNTS rapporterade utrullningen som att OpenAI uppfyller "EU AI Act-mandaten" direkt.
Tidpunkten är anmärkningsvärd. Tillkännagivandet av vattenstämpeln landar mitt i en ovanligt turbulent sträcka för OpenAI:s offentliga ställning: samma nyhetscykel ledde till att säkerhetsledaren David Robinson lämnade, en FTC-utredning om konsumentrisker vid stora AI-labb och en stämning av aktieägare som har hållit företaget under lupp. Vattenmärkning är ett av få regulatoriska krav som OpenAI kan tillgodose fullt ut med infrastruktur snarare än produktändringar, vilket kan förklara varför det skickades först.
The Catch: Watermarks Break Under Editing
OpenAI medger själv den grundläggande begränsningen. Företaget medger att dess vattenstämpel kan försvinna när texten redigeras, och årtionden av forskning om lingvistisk steganografi backade denna oro: parafrasering, översättning eller till och med blygsam omskrivning kan förstöra statistiska vattenstämplar. Alla som är fast beslutna att tvätta AI-text genom ett "humanizer"-verktyg kommer sannolikt att lyckas.
Den svagheten har inte hindrat tillsynsmyndigheter från att kräva vattenmärkning, och den har inte hindrat labb från att skicka den. Det realistiska målet är inte manipuleringssäkert härkomst utan att höja kostnaderna för tillfälligt bedrägeri i stor skala, samma logik som styr valutavattenstämplar. Kritiker, inklusive vissa AI-säkerhetsgrupper som har varit skeptiska till frivilliga branschåtgärder, hävdar att detektorer som endast är tillgängliga för godkända organisationer gör lite för lärare, redaktörer eller plattformar som försöker genomdriva sina egna AI-innehållspolicyer.
Vad det betyder för användare och utvecklare
För ChatGPT- och Codex-användare inom EU kommer ingenting synbart att förändras. Text kommer att se ut och kännas likadant, och ingen etikett kommer att visas på utdata. Vattenstämpeln kommer helt enkelt att finnas där, upptäckbar i princip av OpenAI:s godkända partners.
För utvecklare kommer API-flaggan omedelbart och är värt att utvärdera noggrant: att aktivera den innebär att man accepterar subtila ändringar av tokensampling över varje slutförande, även för användare utanför EU, eftersom API-inställningen är global. Lag med strikt fördröjning eller kvalitetsbudgetar kanske vill jämföra generering av vattenmärken mot deras nuvarande inställningar innan de växlar omkopplaren.
OpenAI säger att mer information om kvalificerade modeller och detektoransökningsprocessen kommer att anlända under de kommande veckorna. Eftersom andra laboratorier står inför samma EU-förpliktelser, är textGrain osannolikt det sista vattenmärkningsschemat som industrin använder i år.
Ligg före AI
Regleringen omformar hur AI-produkter fungerar under huven. Få den senaste AI-utvecklingen på AI Buzz Wire, med policyanalys och modellnyheter uppdaterade under dagen.
Läs fler AI-nyheter här.