Arquivos judiciais recém-abertos no processo de direitos autorais do Authors Guild contra a OpenAI e a Microsoft alegam que executivos e funcionários de ambas as empresas sabiam que seus modelos de IA estavam sendo treinados em livros piratas – e prosseguiram de qualquer maneira, sugerem mensagens internas citadas nos documentos.

A Authors Guild, a maior e mais antiga organização profissional de escritores publicados nos Estados Unidos, com mais de 18 mil membros, divulgou os registros em um comunicado de 21 de setembro, descrevendo documentos divulgados na semana anterior no caso de longa duração. A história ganhou força no fim de semana, quando se tornou uma das postagens mais votadas no Hacker News, reacendendo o debate sobre como os principais laboratórios de IA adquiriram seus dados de treinamento.

O que os registros afirmam

De acordo com o Authors Guild, os documentos não lacrados – apresentados em nome de uma classe de autores de livros – argumentam que as próprias comunicações internas da OpenAI mostram que a empresa entendia que copiar em massa livros protegidos por direitos autorais sem permissão era legalmente arriscado. A declaração da guilda destaca várias frases citadas nos documentos, incluindo referências à aquisição de livros de um “site russo incompleto” e discussões internas sobre o lançamento de produtos “que deixarão as pessoas desempregadas”.

Os documentos também alertam, no enquadramento da guilda, que “os modelos GPT da OpenAI representam uma ameaça existencial para aqueles que escrevem e publicam livros”.

A CEO do Authors Guild, Mary Rasenberger, disse no comunicado que os documentos revelam “um desdém chocante pelos escritores e seu trabalho por meio de decisões repetidas e intencionais de roubar livros em vez de pagar por eles com pleno conhecimento de que seus produtos destruirão as carreiras dos autores”.

É importante notar que estas são alegações apresentadas pelos demandantes numa moção – e não conclusões de facto pelo tribunal. A OpenAI e a Microsoft argumentaram consistentemente que treinar grandes modelos de linguagem em material protegido por direitos autorais constitui uso justo, uma defesa que a administração Trump apoiou anteriormente em uma declaração de interesse apresentada em um caso separado movido pelo The New York Times.

Quem está processando

A lista de demandantes parece um quem é quem nas cartas americanas: o Authors Guild é acompanhado por escritores como David Baldacci, Taylor Branch, Michael Connelly, Sylvia Day, Jonathan Franzen, Christopher Golden, Andrew Sean Greer, John Grisham, David Henry Hwang, Matthew Klam, George R.R. Martin, Jodi Picoult, Stacy Schiff e James Shapiro, entre outros.

A ação coletiva, conhecida como Alter v. OpenAI e Microsoft, é liderada pelo advogado Justin A. Nelson, da firma Susman Godfrey. Faz parte de um litígio multidistrital mais amplo contra as duas empresas pendente no tribunal federal de Manhattan, onde foi consolidada uma lista crescente de casos de direitos autorais contra desenvolvedores de IA.

O caminho processual à frente

Os novos documentos públicos são extraídos de dois registros: o Memorando de Lei dos Requerentes Coletivos em Apoio à Moção para Julgamento Sumário Parcial (Docket 1982) e a Regra Corrigida 56.1 dos Requerentes Coletivos de Fatos Relevantes Incontestados (Docket 1987). Em termos simples, os autores pedem ao tribunal que decida sobre questões fundamentais de responsabilidade sem um julgamento completo, argumentando que o registo factual já é indiscutível.

A Authors Guild diz que espera instruções adicionais nos próximos meses, com uma audiência prevista para o início de 2027. Esse cronograma torna este um dos casos de direitos autorais de IA mais importantes a serem observados no próximo ano, ao lado de ações semelhantes movidas por organizações de notícias, editoras musicais e artistas visuais.

Juntamente com o relatório dos autores, a declaração da guilda faz referência ao que chama de “revelações igualmente abrasadoras, mas separadas” num documento apresentado por organizações de comunicação social com as suas próprias reivindicações de direitos de autor contra as empresas.

Por que as apostas são tão altas

O resultado do caso dos autores poderia remodelar a economia de toda a indústria generativa de IA. Se o tribunal rejeitar a defesa do uso justo e concluir que o treinamento em livros piratas é uma infração, a OpenAI e a Microsoft poderão enfrentar danos que aumentam com o grande número de trabalhos envolvidos – e todo treinamento de laboratório de IA em livros copiados enfrentaria uma exposição semelhante.

Uma decisão a favor dos arguidos, pelo contrário, cimentaria a base jurídica sobre a qual foram construídos a maioria dos modelos de fronteira. De qualquer forma, os documentos não selados proporcionaram ao público uma rara visão de como os produtos mais valiosos da indústria foram realmente fabricados - e os demandantes esperam que o júri possa decidir se esse processo foi legal.

Para escritores que trabalham, o caso vai além do pagamento atrasado. A guilda argumenta que os substitutos gerados pela IA já estão a diminuir a procura de autoria humana, uma afirmação que enquadra o litígio como existencial para o ecossistema editorial, em vez de meramente compensatório.

Espera-se que tanto a OpenAI quanto a Microsoft respondam à moção de julgamento sumário nas próximas semanas. Até então, as citações explosivas continuam a ser alegações – mas alegações agora arquivadas num processo judicial público, onde ancorarão o argumento sempre que este caso se aproximar do julgamento.

Fique à frente da IA

Siga AI Buzz Wire para os mais recentes desenvolvimentos de IA.

Leia mais notícias sobre IA →