OpenAI a anunțat pe 5 octombrie că va începe să adauge filigrane invizibile textului generat de ChatGPT și Codex pentru utilizatorii din Uniunea Europeană, răspunsul său concret la regulile de proveniență a textului din Legea UE AI. Într-o postare pe blog intitulată „Abordarea noastră față de regulile UE de proveniență a textului”, compania a spus că filigranul va fi lansat „în următoarele săptămâni” pentru producția eligibilă în bloc, un plan raportat în aceeași zi de TechCrunch, The Verge, BleepingComputer, Engadget și alte puncte de vânzare.
Tehnologia din spatele schimbării se numește textGrain. În loc să încorporeze un semn vizibil, textGrain funcționează prin direcționarea subtilă a alegerilor de cuvinte ale modelului, astfel încât textul rezultat să poarte un model statistic care poate fi detectat mai târziu. Cititorii nu vor observa nimic atunci când consumă sau copiază text generat de AI; detectarea necesită acces la detectorul OpenAI, care nu este disponibil publicului larg. Pentru o privire mai amplă asupra modului în care autoritățile de reglementare și laboratoarele se ciocnesc în privința regulilor AI, urmați acoperirea noastră în curs de desfășurare a politicii AI.
Cum funcționează textGrain Watermarking
Abordarea OpenAI modifică procesul de selecție a simbolurilor în timpul generării. Compania spune că textGrain „schimbă ușor alegerile de cuvinte ale modelului pentru a crea un model statistic care poate fi detectat ulterior”, conform raportării BleepingComputer. Filigranul este invizibil atunci când textul este citit sau copiat, iar OpenAI susține că nu degradează calitatea ieșirii.
Partea de detectare este restricționată în mod deliberat. Pe lângă lansarea filigranului, OpenAI deschide aplicații pentru detectorul său de filigran, dar accesul va fi inițial limitat la cercetătorii și organizațiile de experți aprobați. Acest design ține capacitatea de detectare departe de mâinile oricui speră să o transforme în armă, dar înseamnă, de asemenea, că editorii, profesorii și angajatorii nu pot verifica în mod independent dacă o bucată de text are filigran.
Accesul API este înscris în întreaga lume
Mandatul UE se aplică rezultatelor ChatGPT și Codex din bloc, dar OpenAI oferă simultan dezvoltatorilor de pretutindeni o alegere. Începând cu 5 octombrie, dezvoltatorii API din întreaga lume pot opta pentru filigranarea textului pentru modelele acceptate. Funcția rămâne dezactivată în mod implicit pe API, o decizie pe care The New Stack a subliniat ca fiind un contrast cu abordarea Anthropic, care a activat marcarea provenienței pentru traficul din UE la începutul acestui an, ca răspuns la aceleași reguli.
Această postură de înscriere îi va liniști pe dezvoltatorii îngrijorați de efectele secundare neprevăzute. Filigranul statistic modifică modul în care sunt eșantionate jetoanele, iar orice modificare a generării implică cel puțin un risc teoretic de schimbare a comportamentului pe cazurile marginale. Făcând watermarking-ul mai degrabă decât un standard, OpenAI transferă decizia de conformitate companiilor care se bazează pe modelele sale.
De ce Legea UE AI a forțat acest lucru
Dispozițiile privind transparența Actului AI al UE impun ca textul generat de IA să fie identificabil ca fiind generat de mașini, o obligație care a împins atât OpenAI, cât și Anthropic către scheme de filigran statistic. Postarea de blog a OpenAI încadrează textGrain ca implementare a acelor cerințe de proveniență, iar PYMNTS a raportat lansarea ca OpenAI întrunind direct „mandatele EU AI Act”.
Momentul este notabil. Anunțul filigranului aterizează pe fondul unei întinderi neobișnuit de turbulente pentru postura publică a OpenAI: același ciclu de știri a adus plecarea liderului de siguranță David Robinson, o investigație FTC privind riscurile pentru consumatori la laboratoarele de IA majore și o atmosferă de proces a acționarilor care a ținut compania sub supraveghere. Filigranul este una dintre puținele cerințe de reglementare pe care OpenAI le poate satisface pe deplin cu infrastructura, mai degrabă decât cu modificările produsului, ceea ce ar putea explica de ce a fost livrat prima.
The Catch: Watermarks Break Under Editing
OpenAI însuși admite limitarea fundamentală. Compania admite că filigranul său poate dispărea atunci când textul este editat, iar decenii de cercetări asupra steganografiei lingvistice susțin această preocupare: parafrazarea, traducerea sau chiar rescrierea modestă pot distruge filigranele statistice. Oricine este hotărât să spăleze textul AI printr-un instrument de „umanizator” va reuși probabil.
Această slăbiciune nu a împiedicat autoritățile de reglementare să solicite filigranare și nu a împiedicat laboratoarele să-l expedieze. Scopul realist nu este proveniența inviolabilă, ci creșterea costului înșelăciunii ocazionale la scară, aceeași logică care guvernează filigranele valutare. Criticii, inclusiv unele grupuri de siguranță AI care au fost sceptici față de măsurile voluntare ale industriei, susțin că detectoarele accesibile numai organizațiilor aprobate nu fac nimic pentru profesori, editori sau platforme care încearcă să-și impună propriile politici privind conținutul AI.
Ce înseamnă pentru utilizatori și dezvoltatori
Pentru utilizatorii ChatGPT și Codex din interiorul UE, nimic nu se va schimba în mod vizibil. Textul va arăta și se va simți la fel și nu va apărea nicio etichetă pe ieșiri. Filigranul va fi pur și simplu acolo, detectabil în principiu de către partenerii aprobați ai OpenAI.
Pentru dezvoltatori, indicatorul API ajunge imediat și merită evaluat cu atenție: pornirea acestuia înseamnă acceptarea unor modificări subtile ale eșantionării jetonelor la fiecare finalizare, chiar și pentru utilizatorii din afara UE, deoarece setarea API-ului este globală. Echipele cu bugete stricte de latență sau calitate ar putea dori să compare generarea cu filigran față de configurația lor actuală înainte de a comuta.
OpenAI spune că mai multe detalii despre modelele eligibile și procesul de aplicare a detectorului vor ajunge în săptămânile următoare. Deoarece alte laboratoare se confruntă cu aceleași obligații UE, textGrain este puțin probabil să fie ultima schemă de filigranare pe care industria o implementează în acest an.
Rămâi înaintea AI
Reglementarea remodelează modul în care produsele AI funcționează sub capotă. Obțineți cele mai recente evoluții AI pe AI Buzz Wire, cu analize de politici și știri model actualizate pe parcursul zilei.
Citiți mai multe știri despre AI aici.