Několik dní poté, co Anthropic začal uvádět neviditelné vodoznaky na Claudových textových a obrazových výstupech, tato funkce generuje přesně ten druh třecích kritiků, jak předpovídali: uživatelé se obávali, že je značky odhalí při používání umělé inteligence v práci nebo ve třídě, vývojáři dokumentují, jak se vodoznak chová ve skutečných pracovních postupech kódování, a malý, ale viditelný trh nástrojů slibujících jeho odstranění.

Antropic říká, že tato změna uvádí Clauda do souladu se zákonem Evropské unie o AI, jehož pravidla transparentnosti se stala vymahatelnou pro nové modely po 2. srpnu 2026. Článek 50 zákona vyžaduje, aby poskytovatelé systémů AI učinili strojově generovaný výstup „detekovatelným jako uměle generovaný“. Společnost Anthropic potvrdila, že všechny nové modely nabízené globálně – nejen v EU – budou označeny obsahem generovaným umělou inteligencí „od prvního dne“ s obdobím odkladu do prosince 2026 pro aktualizaci dříve vydaných modelů. For more context on this story, see our ongoing more AI stories.

Samotné značky jsou neviditelné. Textové výstupy „nesou vložené vodoznaky“, zatímco generované soubory obsahují digitálně podepsaná metadata původu, pokud to formát podporuje, podle článku podpory Anthropic. Dřívější modely Claude budou aktualizovány tak, aby označovaly i text, což znamená, že celý vozový park nakonec orazítkuje svůj výstup.

Vodoznak pokrývá upravený text, nejen vygenerovaný text

Detail, který změnil technickou kuriozitu na odpor, odhalil Ars Technica 13. srpna: vodoznak se vztahuje na obsah, který Claude zpracovává, nejen na obsah, který generuje od začátku. Ars charakterizoval tento přístup jako „nuke it from orbit“, protože Anthropic označuje veškerý zpracovaný obsah tam, kde je podporován, i když to vlastní pokyny EU nevyžadují tam, kde systém umělé inteligence vykonává „asistenční funkci pro standardní úpravy“ – příkladem nařízení je gramatická oprava – nebo kde „podstatně nemění“ text uživatele.

Toto rozlišení je důležité, protože vodoznak použitý na úrovni modelu nemůže odlišit velkoobchodní generaci od opravy čárkou. Ashley Belanger z Ars Technica poznamenal, že Claude možná nakonec orazítkuje přesně ten druh lehce upraveného lidského psaní, podle kterého byl zákon napsán, aby nechal na pokoji. V praxi značka označuje vše, co Claude zpracoval – dokonce i dokument, který člověk napsal a Clauda pouze požádal o vyleštění.

Uživatelé se bojí, že budou přistiženi v práci a ve škole

Reakce uživatelů byla rychlá. TechCrunch 13. srpna oznámil, že někteří uživatelé Claude "jsou naštvaní, že je nové vodoznaky Anthropic přistihnou, jak je používají při svých zaměstnáních, hodinách." Zaměstnanci, kteří se potichu opírají o Clauda při navrhování e-mailů, zpráv nebo prezentací – a studenti, kteří je používají při úkolech – nyní čelí možnosti, že by šéf nebo instruktor mohl ověřit zapojení AI pomocí detekčního nástroje.

Ars Technica zarámovala dynamiku jako „Šarlatové písmeno“ – neviditelný odznak používání AI, který čtenář nevidí, ale instituce brzy ano. Vzhledem k tomu, že vodoznak putuje s textem prostřednictvím kopírování-vkládání a změn formátu, obvyklá obhajoba „jen jsem to trochu upravil“ již nezanechává otisky prstů AI.

Trh stěhování se již rozvíjí

Tam, kde je vodoznak, následuje odvětví odstraňování. SC Media uvedla, že ve dnech po aktualizaci Claude se již objevuje trh s nástroji pro odstraňování AI vodoznaků. Dešifrování zdokumentovalo, že stavitelé se aktivně snaží prolomit schéma značení, zkoumají, jak se chová při parafrázování, překladu a přeformátování.

Dřívější testování naznačuje, že vodoznak je odolný vůči běžné manipulaci, ale v profesionálních podmínkách je netěsný. Pokrytí New Stack dospělo k závěru, že značka „přežije kopírování a vkládání, ale ne skutečný vývojářský pracovní postup“ – což znamená, že vývojáři softwaru, kteří podstatně přepracují kód navržený umělou inteligencí jako součást normálního inženýrství, mohou značku vymazat, aniž by to kdy zamýšleli.

Jak značka vlastně funguje

Široce sdílený vizuální vysvětlovač publikovaný na declaude.org tento mechanismus rozebírá. Text nemá žádné pixely, do kterých by se data skryla, a žádná metadata nepřežijí kopírování a vkládání, takže vodoznak žije v „volbách mezi slovy“. Jak model píše, opakovaně vybírá mezi několika stejně pravděpodobnými dalšími slovy; tajný kryptografický klíč tiše zaujímá tyto výběry směrem k vzoru, který může detekovat pouze držitel klíče.

Tato technika se odvíjí od výzkumu Kirchenbauera et al. z roku 2023, který rozdělil kandidátská slova na „zelené“ a „červené“ seznamy a naklonil generování směrem k zeleným tokenům. SynthID společnosti Google dosáhne podobného cíle jemnější cestou a Google má vodoznakový text z aplikace Gemini a webového prostředí od roku 2024 – jeho API bylo zdokumentovanou výjimkou. Od srpna 2026 nové modely Claude označují text na úrovni modelu, dřívější modely budou následovat.

Skeptici říkají, že odstranění zůstává triviální

Ne každý je přesvědčen, že závody ve zbrojení upřednostňují Anthropic. V široce rozšířené eseji inženýr Sean Goedecke tvrdil, že textové vodoznaky „bude vždy triviální odstranit“, protože text je extrémně komprimované médium – jakákoli změna dostatečně silná, aby přežila rozhodné odstranění, je změnou, které by si lidský čtenář všimnul. Parafrázovací nástroje, překladatelské okružní cesty a záměrné přeformulování – to vše hrozí vydrhnutím statistických vzorců, aniž by došlo ke snížení významu.

Debata se odehrává v komunitách vývojářů: dva samostatné vysvětlovače vodoznaků se tento týden zařadily mezi nejvíce diskutované příběhy na Hacker News a vytvořily mezi nimi stovky bodů zapojení.

Co se stane dál

Společnost Antropic uvedla, že se nakonec podělí o podrobnosti o tom, jak značky detekovat – technickou podporu, kterou nařízení EU vyžaduje –, ale dokud nebude dodán veřejný detekční nástroj, vnější strany nemohou ověřit, jak důkladné označení ve skutečnosti je. Společnost také uznala, že vodoznaky nebudou fungovat na „některých platformách nebo funkcích“, které je nepodporují.

Vzhledem k tomu, že starší modely čelí lhůtě pro splnění požadavků v prosinci 2026 a konkurenční laboratoře sledují, zda uživatelé trestají společnost Anthropic za transparentnost, příštích několik měsíců otestuje návrh, kterému se průmysl roky vyhýbal: zda mohou poskytovatelé umělé inteligence zajistit sledovatelnost jejich výstupu, aniž by to bylo toxické pro lidi, kteří na ně spoléhají.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →