OpenAI 5. října oznámila, že do textu generovaného ChatGPT a Codexem pro uživatele v Evropské unii začne přidávat neviditelné vodoznaky, což je konkrétní odpověď na pravidla původu textu zákona EU o AI Act. V příspěvku na blogu nazvaném „Náš přístup k pravidlům původu textu v EU“ společnost uvedla, že vodoznak bude zaveden „v nadcházejících týdnech“ pro způsobilý výstup v bloku, o plánu, který téhož dne oznámily TechCrunch, The Verge, BleepingComputer, Engadget a další prodejny.

Technologie stojící za změnou se nazývá textGrain. Spíše než vkládání viditelné značky funguje textGrain tak, že jemně řídí výběr slov modelu tak, aby výsledný text nesl statistický vzor, ​​který lze zjistit později. Čtenáři si při konzumaci nebo kopírování textu generovaného umělou inteligencí ničeho nevšimnou; detekce vyžaduje přístup k detektoru OpenAI, který není dostupný široké veřejnosti. Chcete-li získat širší pohled na to, jak se regulační orgány a laboratoře střetávají kvůli pravidlům umělé inteligence, sledujte naše průběžné pokrytí zásad AI.

Jak funguje vodoznak textGrain

Přístup OpenAI modifikuje proces výběru tokenu během generování. Společnost říká, že textGrain "nepatrně mění výběr slov modelu, aby vytvořil statistický vzor, ​​který lze později detekovat," podle zpráv BleepingComputer. Vodoznak je při čtení nebo kopírování textu neviditelný a OpenAI tvrdí, že nesnižuje kvalitu výstupu.

Detekční strana je záměrně omezena. Spolu se spuštěním vodoznaku otevírá OpenAI aplikace pro svůj detektor vodoznaků, ale přístup bude zpočátku omezen na schválené výzkumníky a expertní organizace. Tento design brání detekční schopnosti z rukou komukoli, kdo by ji chtěl použít jako zbraň, ale také to znamená, že vydavatelé, učitelé a zaměstnavatelé nemohou nezávisle ověřit, zda je text opatřen vodoznakem.

Přístup k API je celosvětově volitelný

Mandát EU se vztahuje na výstup ChatGPT a Codex v bloku, ale OpenAI současně dává vývojářům kdekoli na výběr. Od 5. října se mohou vývojáři API po celém světě přihlásit k textovému vodoznaku pro podporované modely. Tato funkce zůstává v rozhraní API ve výchozím nastavení zakázána, což je rozhodnutí, které The New Stack zdůraznil jako kontrast s přístupem společnosti Anthropic, která na začátku tohoto roku zapnula označení původu pro provoz v EU ve své vlastní reakci na stejná pravidla.

Tato opt-in pozice uklidní vývojáře, kteří se obávají nepředvídaných vedlejších účinků. Statistické vodoznaky mění způsob vzorkování tokenů a jakákoli úprava generování s sebou nese přinejmenším teoretické riziko posunu chování na okrajových případech. Tím, že je vodoznak nastaven jako příznak, nikoli jako výchozí, přenáší OpenAI rozhodnutí o shodě na společnosti, které vycházejí z jeho modelů.

Proč si to zákon EU AI vynutil

Ustanovení zákona EU o AI o transparentnosti vyžadují, aby text generovaný umělou inteligencí byl identifikovatelný jako strojově generovaný, což je povinnost, která posunula OpenAI i Anthropic ke statistickým schématům vodoznaků. Blogový příspěvek OpenAI obsahuje textGrain jako implementaci těchto požadavků na provenienci a PYMNTS ohlásilo zavedení jako OpenAI přímo v souladu s „EU AI Act“.

Načasování je pozoruhodné. Oznámení o vodoznaku zapadá do neobvykle turbulentního období pro veřejný postoj OpenAI: stejný zpravodajský cyklus přinesl odchod bezpečnostního lídra Davida Robinsona, vyšetřování FTC ohledně spotřebitelských rizik ve velkých laboratořích AI a atmosféru akcionářských soudních sporů, která drží společnost pod drobnohledem. Vodoznak je jedním z mála regulačních požadavků, které může OpenAI plně uspokojit infrastrukturou spíše než změnami produktu, což může vysvětlovat, proč bylo dodáno jako první.

The Catch: Watermarks break under Editing

Samotné OpenAI připouští zásadní omezení. Společnost připouští, že její vodoznak může zmizet, když je text upraven, a desítky let výzkumu lingvistické steganografie se týkají: parafráze, překlad nebo dokonce skromné ​​přepisování může zničit statistické vodoznaky. Pravděpodobně uspěje každý, kdo je odhodlaný prát text AI pomocí nástroje „humanizer“.

Tato slabina nezabránila regulačním orgánům vyžadovat vodoznak a nezabránila laboratořím v jejich odesílání. Realistickým cílem není původ odolný proti neoprávněné manipulaci, ale zvýšení nákladů na příležitostné klamání ve velkém měřítku, stejná logika, jakou se řídí vodoznaky měn. Kritici, včetně některých bezpečnostních skupin AI, kteří byli skeptičtí k dobrovolným průmyslovým opatřením, tvrdí, že detektory přístupné pouze schváleným organizacím dělají málo pro učitele, editory nebo platformy, které se snaží prosadit své vlastní zásady týkající se obsahu AI.

Co to znamená pro uživatele a vývojáře

Pro uživatele ChatGPT a Codexu v rámci EU se nic viditelně nezmění. Text bude vypadat a působit stejně a na výstupech se neobjeví žádný štítek. Vodoznak tam prostě bude, v principu jej mohou zjistit schválení partneři OpenAI.

Vývojářům příznak API dorazí okamžitě a stojí za to ho pečlivě vyhodnotit: jeho zapnutí znamená přijetí jemných změn vzorkování tokenů při každém dokončení, a to i pro uživatele mimo EU, protože nastavení API je globální. Týmy s přísnou latencí nebo rozpočtem na kvalitu mohou chtít před přepnutím přepínače porovnat generování vodoznaků s jejich aktuálním nastavením.

OpenAI říká, že další podrobnosti o vhodných modelech a procesu aplikace detektoru dorazí v nadcházejících týdnech. Vzhledem k tomu, že ostatní laboratoře čelí stejným povinnostem EU, je nepravděpodobné, že by textGrain byl posledním schématem vodoznaků, které průmysl tento rok zavede.

Udržujte si náskok před umělou inteligencí

Regulace mění způsob, jakým produkty umělé inteligence fungují pod kapotou. Získejte nejnovější vývoj AI na AI Buzz Wire, s analýzou zásad a modelovými novinkami aktualizovanými v průběhu dne.

Další zprávy o AI si přečtěte zde.