La câteva zile după ce Anthropic a început să lanseze filigrane invizibile pe ieșirile de text și imagini ale lui Claude, funcția generează exact genul de fricțiune prezis de critici: utilizatorii s-au îngrijorat că semnele le vor expune pentru utilizarea AI la locul de muncă sau la clasă, dezvoltatorii documentează modul în care filigranul se comportă în fluxurile de lucru reale de codare și o piață mică, dar vizibilă, de instrumente care promit să-l elimine.
Anthropic spune că schimbarea îl aduce pe Claude în conformitate cu Actul AI al Uniunii Europene, ale cărui reguli de transparență au devenit aplicabile pentru noile modele după 2 august 2026. Articolul 50 al actului impune furnizorilor de sisteme AI să facă „detectabile ca producție artificială” producția generată de mașini. Anthropic a confirmat că toate modelele noi oferite la nivel global – nu numai în UE – vor marca conținutul generat de AI „din prima zi”, cu o perioadă de grație până în decembrie 2026 pentru actualizarea modelelor lansate anterior. For more context on this story, see our ongoing AI news.
Semnele în sine sunt invizibile. Ieșirile de text „poartă filigrane încorporate”, în timp ce fișierele generate includ metadate de proveniență semnate digital acolo unde formatul le acceptă, conform unui articol de asistență Anthropic. Modelele anterioare Claude vor fi actualizate pentru a marca și textul, ceea ce înseamnă că întreaga flotă își va ștampila în cele din urmă producția.
Filigranul acoperă textul editat, nu doar textul generat
Detaliul care a transformat curiozitatea tehnică într-o reacție a fost dezvăluit de Ars Technica pe 13 august: filigranul se aplică conținutului Claude procesează, nu doar conținutului pe care îl generează de la zero. Ars a caracterizat abordarea drept „nuke it from orbita”, deoarece Anthropic marchează tot conținutul procesat acolo unde este acceptat, chiar dacă îndrumările proprii ale UE nu o solicită acolo unde un sistem AI îndeplinește „o funcție de asistență pentru editarea standard” – exemplul regulamentului este corecția gramaticală – sau când nu „alterează substanțial” textul unui utilizator.
Această distincție contează deoarece un filigran aplicat la nivel de model nu poate deosebi generarea angro de o remediere prin virgulă. Ashley Belanger de la Ars Technica a remarcat că Claude ar putea sfârși prin a ștampila exact genul de scris uman ușor retușat pe care legea a fost scrisă să o lase în pace. În practică, marca semnalează orice a procesat Claude - chiar și un document pe care l-a scris un om și i-a cerut lui Claude doar să-l șlefuiască.
Utilizatorii se tem să fie prinși la serviciu și la școală
Reacția utilizatorului a fost rapidă. TechCrunch a raportat pe 13 august că unii utilizatori Claude „sunt supărați că noile filigrane ale lui Anthropic îi vor surprinde folosindu-l la joburi, la cursuri”. Angajații care se sprijină în liniște pe Claude pentru a redacta e-mailuri, rapoarte sau diapozitive - și studenții care le folosesc în teme - acum se confruntă cu posibilitatea ca un șef sau un instructor să poată verifica implicarea AI cu un instrument de detectare.
Ars Technica a încadrat dinamica ca o „Scrisoare stacojie” – o insignă invizibilă a utilizării AI pe care cititorul nu o poate vedea, dar instituțiile o pot vedea în curând. Deoarece filigranul se deplasează odată cu textul prin copiere-lipire și modificări de format, apărarea obișnuită a „Tocmai l-am editat un pic” nu mai lasă amprentele AI în urmă.
O piață de îndepărtare este deja în curs de dezvoltare
Acolo unde există un filigran, urmează o industrie de îndepărtare. SC Media a raportat că o piață pentru instrumentele de eliminare a filigranelor AI apare deja în zilele de după actualizarea Claude. Decrypt a documentat că constructorii încearcă în mod activ să încalce schema de marcare, cercetând cum se comportă în parafrazare, traducere și reformatare.
Testele timpurii sugerează că filigranul este robust împotriva manipulării ocazionale, dar curge în condiții profesionale. Acoperirea New Stack a concluzionat că marca „supraviețuiește copy-paste, dar nu fluxului de lucru real al dezvoltatorului” – ceea ce înseamnă că dezvoltatorii de software care reproșează substanțial codul sugerat de AI ca parte a ingineriei normale pot spăla marcajul fără a intenționa vreodată.
Cum funcționează de fapt marca
Un explicator vizual distribuit pe scară largă, publicat pe declaude.org, defalcă mecanismul. Textul nu are pixeli în care să ascundă datele și nicio metadate nu supraviețuiește copierii și lipirii, astfel încât filigranul trăiește în „alegerile dintre cuvinte”. După cum scrie un model, selectează în mod repetat dintre câteva cuvinte următoare la fel de plauzibile; o cheie criptografică secretă modifică în liniște acele selecții către un model pe care numai deținătorul cheii îl poate detecta.
Tehnica se bazează pe cercetările lui Kirchenbauer și colab. din 2023, care a împărțit cuvintele candidate în liste „verzi” și „roșii” și a înclinat generația către jetoane verzi. SynthID de la Google ajunge la o destinație similară printr-o rută mai subtilă, iar Google a marcat textul din aplicația Gemini și din experiența web din 2024 - API-ul său a fost o excepție documentată. Începând cu august 2026, noile modele Claude marchează textul la nivel de model, modelele anterioare fiind programate să urmeze.
Scepticii spun că eliminarea rămâne banală
Nu toată lumea este convinsă că cursa înarmărilor îl favorizează pe Anthropic. Într-un eseu difuzat pe scară largă, inginerul Sean Goedecke a susținut că filigranele de text „vor fi întotdeauna trivial de eliminat”, deoarece textul este un mediu extrem de comprimat - orice schimbare suficient de puternică pentru a supraviețui unei eliminări determinate este o schimbare pe care un cititor uman ar observa. Instrumentele de parafrazare, traducerile dus-întors și reformularea deliberată amenință toate să curățeze modelele statistice fără a degrada sensul.
Dezbaterea se desfășoară în comunitățile de dezvoltatori: două explicatoare separate de filigran s-au clasat printre cele mai discutate povești pe Hacker News săptămâna aceasta, atragând sute de puncte de implicare între ei.
Ce se întâmplă în continuare
Anthropic a spus că în cele din urmă va împărtăși detalii despre modul de detectare a semnelor - suport tehnic pe care regulamentul UE îl cere - dar până când un instrument public de detectare va fi livrat, părțile externe nu pot verifica cât de complet este de fapt marcajul. De asemenea, compania a recunoscut că filigranele nu vor funcționa pe „unele platforme sau funcții” care nu le acceptă.
În condițiile în care modelele mai vechi se confruntă cu un termen limită de conformitate din decembrie 2026 și laboratoarele rivale urmăresc dacă utilizatorii pedepsesc Anthropic pentru transparență, următoarele câteva luni vor testa o propunere pe care industria a evitat-o de ani de zile: dacă furnizorii de AI își pot urmări producția fără a o face toxică pentru oamenii care se bazează pe ea.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →