e seus jornais afiliados processaram a OpenAI no tribunal federal de Nova York em 8 de outubro de 2026, alegando que a empresa treinou seus modelos GPT em centenas de milhares de seus artigos protegidos por direitos autorais sem autorização. O processo, relatado pela primeira vez pela Reuters, busca indenização superior a US$ 250 milhões e acrescenta o maior nome até então na publicação de notícias locais e nacionais à onda de litígios de direitos autorais contra o criador do ChatGPT.
O caso, arquivado como USA Today Co., Inc. OpenAI Foundation no Tribunal Distrital dos EUA para o Distrito Sul de Nova York, chega enquanto tribunais, reguladores e redações continuam a lutar sobre como os sistemas generativos de IA devem tratar o jornalismo protegido por direitos autorais. Para os leitores que acompanham os últimos desenvolvimentos de IA, a denúncia é uma das acusações mais detalhadas sobre como o corpus de treinamento de um laboratório de fronteira foi montado.
O que o processo alega
De acordo com reportagens da Reuters, Forbes e Bloomberg Law, a denúncia alega que os grandes modelos de linguagem da OpenAI foram treinados em material protegido por direitos autorais extraído da Internet sem autorização, independentemente de acesso pago ou outras restrições de acesso. Os demandantes também alegam que a OpenAI usou programas projetados para retirar informações de gerenciamento de direitos autorais, dados de propriedade e direitos anexados a obras publicadas.
De acordo com a estrutura legal citada pela reclamação, os demandantes podem recuperar até US$ 150.000 por cada violação intencional de direitos autorais, mais até US$ 25.000 por violação pela remoção de informações de gerenciamento de direitos autorais. O processo exige um julgamento com júri.
Os registros, descritos em detalhes pela Unite.AI com base na pauta do tribunal, foram acompanhados por uma exposição de registros de direitos autorais e uma segunda exposição de exemplos de saída do GPT-5.6. Esses exemplos, de acordo com a denúncia, mostram o modelo produzindo extensos resumos de múltiplas seções que parafraseiam artigos originais e seguem sua organização estrutural quando solicitados a encontrar uma história específica por título.
Os números da reclamação
A denúncia afirma que o conteúdo das publicações dos demandantes compreende mais de 160.000 entradas no WebText, o corpus interno OpenAI construído para treinar GPT-2, incluindo 83.266 entradas de usatoday.com e 12.994 entradas de freep.com, o domínio Detroit Free Press. Ele também afirma que os domínios das publicações são responsáveis por mais de 122 milhões de tokens em C4, um subconjunto filtrado em inglês de um instantâneo de 2019 do arquivo da web Common Crawl.
Para argumentar que a OpenAI entendeu o que seus modelos continham, a denúncia cita comunicações internas. Afirma que o cofundador Greg Brockman disse aos colegas que os modelos eram particularmente bons em prever o texto de artigos de notícias, e que uma apresentação de 2020 do então líder de pesquisa Dario Amodei listou a geração de notícias entre as habilidades do GPT-3. A reclamação também cita um vice-presidente de pesquisa da OpenAI afirmando: “Treinamos nossas redes para memorizar os dados de treinamento – esse é o objetivo deles”.
A reclamação cita ainda provas escritas que a OpenAI apresentou a um inquérito da Câmara dos Lordes britânica em dezembro de 2023, nas quais a empresa afirmou que, como os direitos de autor abrangem praticamente todo o tipo de expressão humana, limitar os dados de formação a obras de domínio público não produziria sistemas de IA competitivos.
Suposto papel da Microsoft
O processo também inclui alegações sobre a Microsoft, parceira comercial próxima da OpenAI. De acordo com a denúncia, a Microsoft forneceu à OpenAI uma cópia do Bing Index, uma compilação de bilhões de páginas da web copiadas que incluíam o conteúdo dos demandantes, sob uma iniciativa chamada Project Taxi durante um período de três anos. Alega ainda que a Microsoft desenvolveu e operou separadamente um rastreador chamado Project Mango em nome da OpenAI, pelo qual a OpenAI pagou à Microsoft.
A reclamação alega que os filtros de saída da OpenAI não suprimiram conteúdo de editores que ainda não haviam processado a empresa, uma abordagem que um executivo da Microsoft descreveu internamente em termos pouco lisonjeiros. Os demandantes estão perseguindo apenas entidades OpenAI; A Microsoft não é réu neste caso, embora enfrente reivindicações semelhantes em ações anteriores de editores.
Quem está processando e quem está sendo processado
Os demandantes, todos de propriedade da USA Today Co., detêm direitos autorais de conteúdo publicado por 19 publicações, incluindo USA TODAY, The Tennessean, the Indy Star, The Bergen Record, The Enquirer, the Asbury Park Press, the Democrat & Chronicle, The Knoxville News-Sentinel, the Naples Daily News, The Oklahoman, the Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, The Des Moines Registre-se, o Detroit Free Press, o Detroit News, o Palm Beach Post e o Star News. USA Today Co. é a antiga Gannett Co., Inc.
Os réus são sete entidades OpenAI, incluindo a OpenAI Foundation, a organização sem fins lucrativos que surgiu com participação acionária na empresa com fins lucrativos após a recapitalização da empresa em outubro de 2025, e o OpenAI Group PBC, a corporação de utilidade pública que agora abriga o negócio comercial. Os modelos em questão abrangem GPT-1 a GPT-6.1 e as versões de peso aberto GPT-OSS, incluindo todas as variantes Instant, Thinking, mini, nano e Pro, de acordo com a reclamação.
Substituição é a teoria central
Um tema central da denúncia é a substituição. Os demandantes alegam que a OpenAI pós-treinou afirmativamente seus modelos para resumir artigos protegidos por direitos autorais em vez de devolver os próprios artigos, produzindo substitutos que atendem ao mesmo propósito informativo dos originais. A reclamação cita o chefe do ChatGPT da OpenAI reconhecendo que, uma vez que o chatbot dá uma resposta, “não há uma boa razão para clicar” em um link para a fonte subjacente, e cita a declaração de um engenheiro da OpenAI de que os usuários não clicarão nos links, não importa quão proeminentemente eles sejam exibidos.
Essa teoria ecoa argumentos de casos anteriores. O New York Times processou a OpenAI e a Microsoft em dezembro de 2023, e veículos como o Seattle Times e o Newsday entraram com seus próprios processos de direitos autorais. Uma declaração de parentesco apresentada à ação do USA Today pede que ela seja tratada como relacionada ao litígio consolidado de direitos autorais da OpenAI já pendente no mesmo tribunal.
Por que é importante
O resultado dos casos consolidados poderá definir durante anos a economia dos resumos de notícias gerados pela IA. Os editores argumentam que as respostas do chatbot que recapitulam suas reportagens destroem o tráfego que as financia; As empresas de IA argumentam que o treinamento em textos disponíveis ao público é um uso justo e transformador. A OpenAI ainda não respondeu publicamente à reclamação do USA Today, e respostas anteriores em ações semelhantes enfatizaram parcerias de licenciamento e contestaram a leitura dos demandantes sobre uso justo.
Para a cobertura contínua deste caso e das notícias de última hora sobre IA que moldam o setor, fique atento à medida que o litígio avança pelo Distrito Sul de Nova York.
---
Fique à frente da IAReceba as últimas notícias, análises e avanços sobre IA — tudo em um só lugar.
Leia mais notícias sobre IA →