Společnost Anthropic začne používat neviditelné vodoznaky na text generovaný svými modely Claude, potvrdila společnost tento týden a stala se nejnovějším poskytovatelem umělé inteligence, který přidává strojově čitelné signály původu v reakci na nová evropská pravidla transparentnosti.
Změna, která je podrobně popsána na aktualizované stránce podpory, znamená, že obsah vytvořený Claudem ponese skrytý podpis navržený tak, aby přežil zkopírování a vložení jinam. Jde o přímou reakci na zákon Evropské unie o transparentnosti AI Act Transparency Code, který vstoupil v platnost 2. srpna a vyžaduje, aby společnosti zabývající se umělou inteligencí označovaly generovaný nebo upravovaný obsah způsobem, který ostatní systémy dokážou odhalit.
Jak funguje vodoznak
Společnost Anthropic uvedla, že všechny modely vydané po 2. srpnu budou automaticky obsahovat technologii pro vodoznak jak počítačově generovaného textu, tak souborů. Pokud jde o soubory, společnost přijímá otevřený standard C2PA, rámec pověření obsahu, který již používají někteří výrobci fotoaparátů a nástroje pro úpravu obrázků k zaznamenání toho, jak bylo médium vytvořeno.
Textový vodoznak je vložen na úrovni modelu, nikoli jako dodatečný nápad. Podle podpůrné dokumentace Anthropic "protože vodoznak je součástí textu, bude cestovat s textem, když je zkopírován a vložen jinam, a může přetrvávat i při některých úpravách. Vodoznak bude aplikován na úrovni modelu, což znamená, že bude přítomen bez ohledu na to, z kterého produktu Claude nebo povrchu text pochází."
Společnost dodala, že plánuje rozšířit podporu vodoznaků i na starší modely. Tato funkce se bude vztahovat na celou produktovou řadu Anthropic, včetně rozhraní API platformy Claude, chatovací aplikace Claude, kódu Claude, Claude Cowork a Claude Tag.
Není zcela jasné, kolik úprav by uživatel musel udělat, aby značku odstranil, a Anthropic tuto techniku veřejně nepopsal. Textové vodoznaky jsou technicky obtížné, protože malé změny ve formulaci mohou narušit křehké statistické vzorce, což je dlouhodobá výzva pro výzkumníky v této oblasti.
Žádné odhlášení pro uživatele
Zejména uživatelé Claude nebudou moci vodoznak zakázat. Nastavení je vynuceno samotným modelem, nikoli přepínáním podle požadavku, což znamená, že každý, kdo generuje text prostřednictvím povrchu Claude, jej bude mít označeno, zda to chce nebo ne.
Tento postoj pravděpodobně vyvolá odpor od některých profesionálních uživatelů. Spisovatelé, vývojáři a firmy, které používají Claude k navrhování obsahu, si zvykli na čistý, neoznačený výstup a některým může být nepříjemné, když jejich text na internetu následuje neviditelný podpis. Zdá se, že společnost Antropic dospěla k závěru, že dodržování předpisů převažuje nad touto preferencí.
Součást širšího průmyslového tahanice
Antropický nejedná sám. Požadavky EU na transparentnost odstartovaly závod mezi platformami umělé inteligence a obsahu o přidání signálů o původu dříve, než začnou regulační orgány klepat.
Jen minulý týden hudební platforma AI Suno uvedla, že začne označovat skladby vytvořené v její službě po vlně právních sporů ohledně zvuku generovaného AI. Minulý měsíc se platforma pro zpravodaje Substack spojila s detekční firmou Pangram, aby označila obsah generovaný umělou inteligencí, přičemž generální ředitel Substack Chris Best veřejně zvolal „Claudefishing“, což je termín pro lidi používající umělou inteligenci k zaplavení platforem materiálem nízké kvality.
Tlak daleko přesahuje přímé konkurenty Anthropic. Black Forest Labs, Google, Meta, Microsoft, OpenAI a Synthesia se všechny zavázaly dodržovat kodex transparentnosti EU, podle zprávy TechCrunch, což signalizuje, že vodoznaky se rychle stávají základním očekáváním odvětví spíše než rozlišovacím znakem.
Proč je provenience náhle naléhavá
Tlak na vodoznaky odráží dvě sbližující se úzkosti. První je regulační: nyní je v platnosti zákon EU o umělé inteligenci a společnosti, které nedodrží, hrozí značné sankce. Včasné zavedení původní infrastruktury je levnější než její dodatečné vybavení pod tlakem vymáhání.
Druhý je reputační. Vzhledem k tomu, že text, obrázky, zvuk a video generované umělou inteligencí zaplavily sociální platformy, vydavatelé a platformy čelí rostoucím odporům ohledně „AI slop“, syntetického obsahu nízké kvality, který vytlačuje lidskou práci a narušuje důvěru. Neviditelné vodoznaky nabízejí technickou odpověď na otázku, kterou moderování samo o sobě nevyřeší: napsal to stroj?
Pro společnost Anthropic, která postavila svou značku na bezpečnosti umělé inteligence, je přijetí vodoznaků také krokem k důvěryhodnosti. Společnost, která se prodává jako odpovědná alternativa, má silné pobídky k tomu, aby vedla v oblasti transparentnosti, spíše než aby byla viděna, jak se táhne.
Těžší otázky zůstávají nevyřešeny. Vodoznaky pomáhají pouze tehdy, pokud je detekční nástroje skutečně vyhledávají a pokud jsou značky dostatečně robustní, aby přežily úpravy, přeformátování a praní, ke kterým dochází při pohybu obsahu po otevřeném webu. Sázka společnosti Anthropic je, že začlenění signálu na úrovni modelu je nejtrvanlivějším přístupem. Zda obstojí v praxi, bude rychle a veřejně testováno v následujících měsících.
Pro průběžné pokrytí zásad umělé inteligence a nástrojů přetvářejících toto odvětví si uložte záložku Aktuální zpravodajství o AI Buzz Wire.
