USA Today Co., Inc. e i suoi giornali affiliati hanno citato in giudizio OpenAI presso il tribunale federale di New York l'8 ottobre 2026, sostenendo che la società ha addestrato i suoi modelli GPT su centinaia di migliaia di articoli protetti da copyright senza autorizzazione. La causa, riportata per la prima volta da Reuters, chiede un risarcimento di oltre 250 milioni di dollari e aggiunge il nome più grande mai pubblicato nell'editoria di notizie locali e nazionali all'ondata di controversie sul copyright contro il produttore di ChatGPT.

Il caso, registrato come USA Today Co., Inc. contro OpenAI Foundation presso il tribunale distrettuale degli Stati Uniti per il distretto meridionale di New York, arriva mentre tribunali, regolatori e redazioni continuano a lottare su come i sistemi di intelligenza artificiale generativa dovrebbero trattare il giornalismo protetto da copyright. Per i lettori che seguono gli ultimi sviluppi dell'intelligenza artificiale, la denuncia è una delle accuse più dettagliate finora su come è stato assemblato il corpus di formazione di un laboratorio di frontiera.

Cosa sostiene la causa

Secondo quanto riferito da Reuters, Forbes e Bloomberg Law, la denuncia sostiene che i grandi modelli linguistici di OpenAI sono stati addestrati su materiale protetto da copyright prelevato da Internet senza autorizzazione, indipendentemente dai paywall o da altre restrizioni di accesso. I ricorrenti sostengono inoltre che OpenAI abbia utilizzato programmi progettati per eliminare le informazioni sulla gestione del copyright, la proprietà e i dati sui diritti allegati alle opere pubblicate.

Secondo il quadro normativo citato nella denuncia, i querelanti possono recuperare fino a 150.000 dollari per ogni violazione intenzionale del copyright, più fino a 25.000 dollari per violazione per la rimozione delle informazioni sulla gestione del copyright. La causa richiede un processo con giuria.

I documenti, descritti in dettaglio da Unite.AI sulla base degli atti del tribunale, erano accompagnati da un file di registrazioni di copyright e da un secondo file di esempi di output GPT-5.6. Tali esempi, secondo la denuncia, mostrano che il modello produce ampi riassunti in più sezioni che parafrasano gli articoli originali e ne seguono l'organizzazione strutturale quando viene richiesto di trovare una storia specifica in base al titolo.

I numeri della denuncia

La denuncia afferma che il contenuto delle pubblicazioni dei querelanti comprende più di 160.000 voci in WebText, il corpus interno OpenAI creato per addestrare GPT-2, incluse 83.266 voci da usatoday.com e 12.994 voci da freep.com, il dominio della Detroit Free Press. Afferma inoltre che i domini delle pubblicazioni rappresentano oltre 122 milioni di token in C4, un sottoinsieme filtrato in lingua inglese di un'istantanea del 2019 dell'archivio web Common Crawl.

Per sostenere che OpenAI avesse capito cosa contenevano i suoi modelli, la denuncia cita comunicazioni interne. Si afferma che il co-fondatore Greg Brockman ha detto ai colleghi che i modelli erano particolarmente bravi nel prevedere il testo degli articoli di notizie e che una presentazione del 2020 dell’allora leader della ricerca Dario Amodei elencava la generazione di notizie tra le competenze di GPT-3. La denuncia cita anche un vicepresidente della ricerca di OpenAI che afferma: "Addestriamo le nostre reti a memorizzare i dati di addestramento: questo è il loro obiettivo".

La denuncia cita inoltre prove scritte presentate da OpenAI a un'indagine della Camera dei Lord britannica nel dicembre 2023, in cui la società affermava che, poiché il copyright copre praticamente ogni tipo di espressione umana, limitare i dati di addestramento alle opere di dominio pubblico non produrrebbe sistemi di intelligenza artificiale competitivi.

Presunto ruolo di Microsoft

Il documento contiene anche accuse contro Microsoft, lo stretto partner commerciale di OpenAI. Secondo la denuncia, Microsoft ha fornito a OpenAI una copia dell'indice Bing, una raccolta di miliardi di pagine web raschiate che includevano i contenuti dei querelanti, nell'ambito di un'iniziativa denominata in codice Project Taxi per un periodo di tre anni. Si sostiene inoltre che Microsoft abbia sviluppato e gestito separatamente un crawler chiamato Project Mango per conto di OpenAI, per il quale OpenAI ha pagato Microsoft.

La denuncia sostiene che i filtri di output di OpenAI non hanno eliminato i contenuti degli editori che non avevano ancora fatto causa alla società, un approccio che secondo un dirigente di Microsoft ha descritto internamente in termini poco lusinghieri. I ricorrenti perseguono solo entità OpenAI; Microsoft non è un imputato nominato in questo caso, sebbene debba affrontare affermazioni simili in precedenti cause legali contro gli editori.

Chi fa causa e chi viene citato in giudizio

I querelanti, tutti di proprietà di USA Today Co., detengono i diritti d'autore sui contenuti pubblicati da 19 pubblicazioni, tra cui USA TODAY, The Tennessean, the Indy Star, The Bergen Record, The Enquirer, the Asbury Park Press, the Democrat & Chronicle, The Knoxville News-Sentinel, the Naples Daily News, The Oklahoman, the Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, Il Des Moines Register, il Detroit Free Press, il Detroit News, il Palm Beach Post e lo Star News. USA Today Co. è l'ex Gannett Co., Inc.

Gli imputati sono sette entità OpenAI, tra cui la OpenAI Foundation, l'organizzazione no-profit emersa detenendo partecipazioni nella società a scopo di lucro dopo la ricapitalizzazione della società nell'ottobre 2025, e OpenAI Group PBC, la società di pubblica utilità che ora ospita l'attività commerciale. Secondo la denuncia, i modelli in questione vanno da GPT-1 a GPT-6.1 e alle versioni open-weight GPT-OSS, comprese tutte le varianti Instant, Thinking, mini, nano e Pro.

La sostituzione è la teoria fondamentale

Un tema centrale della denuncia è la sostituzione. I ricorrenti sostengono che OpenAI ha positivamente addestrato i suoi modelli per riassumere gli articoli protetti da copyright invece di restituire gli articoli stessi, producendo sostituti che hanno lo stesso scopo informativo degli originali. La denuncia cita il capo di ChatGPT di OpenAI che riconosce che una volta che il chatbot dà una risposta, non c'è "nessuna buona ragione per fare clic" su un collegamento alla fonte sottostante e cita la dichiarazione di un ingegnere di OpenAI secondo cui gli utenti non faranno clic sui collegamenti, non importa quanto siano ben visibili.

Questa teoria riecheggia argomentazioni in casi precedenti. Il New York Times ha citato in giudizio OpenAI e Microsoft nel dicembre 2023 e testate tra cui il Seattle Times e Newsday hanno intentato le proprie cause sul copyright. Una dichiarazione di correlazione depositata con l'azione USA Today chiede che venga trattata come correlata al contenzioso consolidato sul copyright di OpenAI già pendente nello stesso tribunale.

Perché è importante

L’esito dei casi consolidati potrebbe definire per anni gli aspetti economici dei riassunti delle notizie generati dall’intelligenza artificiale. Gli editori sostengono che le risposte dei chatbot che riassumono i loro rapporti distruggono il traffico che li finanzia; Le società di intelligenza artificiale sostengono che la formazione sul testo disponibile al pubblico rappresenta un fair use trasformativo. OpenAI non ha ancora risposto pubblicamente alla denuncia di USA Today, e precedenti risposte in cause simili hanno enfatizzato le partnership di licenza e contestato la lettura del fair use da parte dei querelanti.

Per continuare la copertura di questo caso e delle ultime notizie sull'intelligenza artificiale che stanno plasmando il settore, restate sintonizzati mentre il contenzioso si sposta nel distretto meridionale di New York.

---

Stai al passo con l'intelligenza artificiale

Ricevi le ultime notizie, analisi e scoperte sull'intelligenza artificiale, tutto in un unico posto.

Leggi altre notizie sull'AI →