OpenAI ha annunciato il 5 ottobre che inizierà ad aggiungere filigrane invisibili al testo generato da ChatGPT e Codex per gli utenti dell'Unione Europea, la sua risposta concreta alle regole sulla provenienza del testo dell'EU AI Act. In un post sul blog intitolato "Il nostro approccio alle regole di provenienza del testo dell'UE", la società ha affermato che la filigrana verrà implementata "nelle prossime settimane" per la produzione idonea nel blocco, un piano riportato lo stesso giorno da TechCrunch, The Verge, BleepingComputer, Engadget e altri punti vendita.
La tecnologia alla base del cambiamento si chiama textGrain. Invece di incorporare un segno visibile, textGrain funziona guidando in modo sottile le scelte delle parole del modello in modo che il testo risultante contenga uno schema statistico che può essere rilevato in seguito. I lettori non noteranno nulla durante il consumo o la copia di testo generato dall'intelligenza artificiale; il rilevamento richiede l'accesso al rilevatore di OpenAI, che non è disponibile al pubblico in generale. Per uno sguardo più ampio su come regolatori e laboratori si scontrano sulle regole dell’IA, segui la nostra copertura politica in corso sull’IA.
Come funziona la filigrana textGrain
L'approccio di OpenAI modifica il processo di selezione dei token durante la generazione. L'azienda afferma che textGrain "modifica leggermente le scelte delle parole del modello per creare un modello statistico che può essere successivamente rilevato", secondo il rapporto di BleepingComputer. La filigrana è invisibile quando il testo viene letto o copiato e OpenAI afferma che non riduce la qualità dell'output.
Il lato di rilevamento è volutamente limitato. Oltre al lancio della filigrana, OpenAI sta aprendo applicazioni per il suo rilevatore di filigrane, ma l’accesso sarà inizialmente limitato a ricercatori approvati e organizzazioni di esperti. Questo design mantiene la capacità di rilevamento fuori dalle mani di chiunque speri di utilizzarla come arma, ma significa anche che editori, insegnanti e datori di lavoro non possono verificare in modo indipendente se una parte di testo è filigranata.
L'accesso API è attivabile in tutto il mondo
Il mandato dell’UE si applica all’output di ChatGPT e Codex nel blocco, ma OpenAI offre allo stesso tempo agli sviluppatori di tutto il mondo una scelta. A partire dal 5 ottobre, gli sviluppatori API di tutto il mondo possono attivare la filigrana del testo per i modelli supportati. La funzionalità rimane disabilitata per impostazione predefinita sull'API, una decisione che The New Stack ha evidenziato come in contrasto con l'approccio di Anthropic, che ha attivato la marcatura della provenienza per il traffico UE all'inizio di quest'anno in risposta alle stesse regole.
Questa posizione di adesione rassicurerà gli sviluppatori preoccupati per gli effetti collaterali imprevisti. Il watermarking statistico cambia il modo in cui i token vengono campionati e qualsiasi modifica alla generazione comporta almeno un rischio teorico di spostare il comportamento nei casi limite. Rendendo la filigrana un flag anziché un valore predefinito, OpenAI trasferisce la decisione di conformità alle aziende che si basano sui suoi modelli.
Perché la legge UE sull'intelligenza artificiale ha imposto ciò
Le disposizioni sulla trasparenza dell’EU AI Act richiedono che il testo generato dall’intelligenza artificiale sia identificabile come generato dalla macchina, un obbligo che ha spinto sia OpenAI che Anthropic verso schemi di watermarking statistico. Il post sul blog di OpenAI inquadra textGrain come l'implementazione di tali requisiti di provenienza e PYMNTS ha segnalato il lancio come OpenAI che soddisfa direttamente i "mandati dell'EU AI Act".
Il tempismo è notevole. L'annuncio della filigrana si colloca in un periodo insolitamente turbolento per la posizione pubblica di OpenAI: lo stesso ciclo di notizie ha portato alla partenza del leader della sicurezza David Robinson, a un'indagine della FTC sui rischi per i consumatori nei principali laboratori di intelligenza artificiale e a un'atmosfera di causa tra gli azionisti che ha tenuto l'azienda sotto esame. La filigrana è una delle poche richieste normative che OpenAI può soddisfare pienamente con l'infrastruttura piuttosto che con le modifiche del prodotto, il che potrebbe spiegare perché è stato spedito per primo.
Il problema: le filigrane si rompono durante la modifica
La stessa OpenAI ammette la limitazione fondamentale. L'azienda ammette che la filigrana può scomparire quando il testo viene modificato, e decenni di ricerca sulla steganografia linguistica confermano tale preoccupazione: parafrasi, traduzioni o anche una modesta riscrittura possono distruggere le filigrane statistiche. Chiunque sia determinato a riciclare il testo dell’intelligenza artificiale attraverso uno strumento “umanizzatore” probabilmente avrà successo.
Questa debolezza non ha impedito agli enti regolatori di richiedere la filigrana, né ai laboratori di fornirla. L’obiettivo realistico non è una provenienza a prova di manomissione, ma l’aumento del costo dell’inganno casuale su larga scala, la stessa logica che governa le filigrane valutarie. I critici, inclusi alcuni gruppi per la sicurezza dell’IA che sono stati scettici nei confronti delle misure volontarie del settore, sostengono che i rilevatori accessibili solo alle organizzazioni approvate fanno poco per insegnanti, editori o piattaforme che cercano di applicare le proprie politiche sui contenuti dell’IA.
Cosa significa per utenti e sviluppatori
Per gli utenti ChatGPT e Codex all'interno dell'UE, nulla cambierà visibilmente. Il testo avrà lo stesso aspetto e nessuna etichetta apparirà sugli output. La filigrana sarà semplicemente lì, rilevabile in linea di principio dai partner approvati di OpenAI.
Per gli sviluppatori il flag API arriva subito e vale la pena valutarlo attentamente: attivarlo significa accettare piccole modifiche al campionamento dei token ad ogni completamento, anche per gli utenti extra-UE, visto che l'impostazione API è globale. I team con una latenza rigorosa o budget di qualità potrebbero voler confrontare la generazione con filigrana con la loro configurazione attuale prima di attivare l'interruttore.
OpenAI afferma che maggiori dettagli sui modelli idonei e sul processo di richiesta del rilevatore arriveranno nelle prossime settimane. Poiché altri laboratori devono affrontare gli stessi obblighi dell’UE, è improbabile che textGrain sia l’ultimo sistema di watermarking adottato dal settore quest’anno.
Stai al passo con l'intelligenza artificiale
La regolamentazione sta rimodellando il modo in cui funzionano i prodotti di intelligenza artificiale. Ricevi gli ultimi sviluppi dell'intelligenza artificiale su AI Buzz Wire, con analisi delle politiche e notizie sui modelli aggiornate durante il giorno.
Leggi altre notizie sull'IA qui.