I documenti giudiziari recentemente aperti nella causa sul copyright della Authors Guild contro OpenAI e Microsoft sostengono che i dirigenti e i dipendenti di entrambe le società sapevano che i loro modelli di intelligenza artificiale venivano addestrati su libri piratati - e procedevano comunque, suggeriscono i messaggi interni citati nei documenti.
La Authors Guild, la più antica e grande organizzazione professionale di scrittori pubblicati negli Stati Uniti con più di 18.000 membri, ha reso pubblici i documenti depositati in una dichiarazione del 21 settembre che descrive i documenti rilasciati la settimana precedente nel caso di lunga data. La storia ha guadagnato nuova popolarità durante il fine settimana quando è diventata uno dei post più votati su Hacker News, riaccendendo il dibattito su come i principali laboratori di intelligenza artificiale hanno acquisito i dati di addestramento.
Cosa affermano i documenti
Secondo la Authors Guild, le memorie non sigillate, depositate per conto di una classe di autori di libri, sostengono che le comunicazioni interne di OpenAI mostrano che la società aveva capito che la copia di massa di libri protetti da copyright senza autorizzazione era legalmente rischiosa. La dichiarazione della gilda evidenzia diverse frasi citate dai documenti, inclusi riferimenti all'approvvigionamento di libri da un "sito web russo impreciso" e discussioni interne sul rilascio di prodotti "che renderanno le persone disoccupate".
I documenti avvertono inoltre, secondo la definizione della gilda, che "i modelli GPT di OpenAI rappresentano una minaccia esistenziale per coloro che scrivono e pubblicano libri".
L'amministratore delegato della Authors Guild Mary Rasenberger ha affermato nella dichiarazione che i documenti rivelano "uno scioccante disprezzo per gli scrittori e il loro lavoro attraverso decisioni ripetute e intenzionali di rubare libri piuttosto che pagarli con la piena consapevolezza che i loro prodotti distruggeranno le carriere degli autori".
È importante notare che si tratta di accuse avanzate dai ricorrenti in una mozione, non di accertamenti di fatto da parte della corte. OpenAI e Microsoft hanno costantemente sostenuto che l'addestramento di modelli linguistici di grandi dimensioni su materiale protetto da copyright costituisce un uso corretto, una difesa che l'amministrazione Trump ha precedentemente sostenuto in una dichiarazione di interessi depositata in un caso separato portato dal New York Times.
Chi fa causa
L'elenco dei querelanti si legge come un chi è chi delle lettere americane: alla Authors Guild si uniscono scrittori tra cui David Baldacci, Taylor Branch, Michael Connelly, Sylvia Day, Jonathan Franzen, Christopher Golden, Andrew Sean Greer, John Grisham, David Henry Hwang, Matthew Klam, George R.R. Martin, Jodi Picoult, Stacy Schiff e James Shapiro, tra gli altri.
L'azione collettiva, nota come Alter v. OpenAI e Microsoft, è guidata dall'avvocato Justin A. Nelson della società Susman Godfrey. Fa parte di un più ampio contenzioso multidistrettuale contro le due società pendente presso il tribunale federale di Manhattan, dove è stato consolidato un numero crescente di casi di copyright contro sviluppatori di intelligenza artificiale.
La strada procedurale da percorrere
I nuovi documenti pubblici sono tratti da due documenti depositati: il Memorandum of Law dei Class Querelanti a sostegno della mozione per una sentenza sommaria parziale (Docket 1982) e il Class Querelanti' Corrected Rule 56.1 Statement of Undisputed Material Facts (Docket 1987). In parole povere, gli autori chiedono alla corte di pronunciarsi sulle questioni principali di responsabilità senza un processo completo, sostenendo che i fatti sono già indiscussi.
La Authors Guild afferma di aspettarsi ulteriori briefing nei prossimi due mesi, con un'udienza prevista all'inizio del 2027. Questa sequenza temporale rende questo uno dei casi di copyright sull'intelligenza artificiale più importanti da tenere d'occhio nel prossimo anno, insieme a cause simili intentate da testate giornalistiche, editori musicali e artisti visivi.
Accanto al brief degli autori, la dichiarazione della gilda fa riferimento a quelle che definisce "rivelazioni altrettanto scottanti ma separate" in un documento presentato da organizzazioni di mezzi di informazione con le proprie rivendicazioni di copyright contro le società.
Perché la posta in gioco è così alta
L’esito del caso degli autori potrebbe rimodellare l’economia dell’intero settore dell’intelligenza artificiale generativa. Se la corte respingesse la difesa del fair use e ritenesse che la formazione sui libri piratati costituisse una violazione, OpenAI e Microsoft potrebbero affrontare danni che aumentano con l’enorme numero di lavori coinvolti – e ogni formazione di laboratorio di intelligenza artificiale sui libri piratati si troverebbe ad affrontare un’esposizione simile.
Una sentenza a favore degli imputati, al contrario, consoliderebbe le basi giuridiche su cui è stata costruita la maggior parte dei modelli di frontiera. In ogni caso, le memorie non sigillate hanno offerto al pubblico uno sguardo raro su come sono stati effettivamente realizzati i prodotti più preziosi del settore - e i querelanti sperano in un giudizio finale di una giuria sulla legittimità di tale processo.
Per gli scrittori che lavorano, il caso riguarda qualcosa di più della retribuzione arretrata. La gilda sostiene che i sostituti generati dall’intelligenza artificiale stanno già deprimendo la domanda di paternità umana, un’affermazione che inquadra il contenzioso come esistenziale per l’ecosistema editoriale piuttosto che meramente compensativo.
Sia OpenAI che Microsoft dovrebbero rispondere alla mozione di giudizio sommario nelle prossime settimane. Fino ad allora, le citazioni esplosive rimangono accuse, ma accuse ora depositate in un fascicolo del tribunale pubblico, dove ancoreranno l’argomentazione ogni volta che questo caso si avvicina al processo.
Stai al passo con l'intelligenza artificialeSegui AI Buzz Wire per gli ultimi sviluppi dell'intelligenza artificiale.
Leggi altre notizie sull'AI →