Des documents judiciaires récemment non scellés dans le cadre du procès pour droits d'auteur de la Authors Guild contre OpenAI et Microsoft allèguent que les dirigeants et les employés des deux sociétés savaient que leurs modèles d'IA étaient formés sur des livres piratés – et ont quand même procédé, suggèrent les messages internes cités dans les documents.

La Authors Guild, la plus ancienne et la plus grande organisation professionnelle d'écrivains publiés aux États-Unis, avec plus de 18 000 membres, a rendu public ces documents dans un communiqué du 21 septembre décrivant les documents publiés la semaine précédente dans cette affaire de longue date. L'histoire a gagné en popularité au cours du week-end lorsqu'elle est devenue l'un des articles les plus votés sur Hacker News, relançant le débat sur la manière dont les principaux laboratoires d'IA ont acquis leurs données de formation.

Ce que prétendent les documents déposés

Selon l'Authors Guild, les mémoires non scellés – déposés au nom d'une classe d'auteurs de livres – affirment que les propres communications internes d'OpenAI montrent que l'entreprise a compris que la copie massive de livres protégés par le droit d'auteur sans autorisation était juridiquement risquée. La déclaration de la guilde met en évidence plusieurs phrases citées dans les documents, y compris des références à la recherche de livres sur un « site Web russe sommaire » et à des discussions internes sur la sortie de produits « qui mettront les gens au chômage ».

Les documents avertissent également, dans le cadre de la guilde, que « les modèles GPT d'OpenAI constituent une menace existentielle pour ceux qui écrivent et publient des livres ».

Mary Rasenberger, PDG de la Authors Guild, a déclaré dans un communiqué que les documents révèlent "un mépris choquant pour les écrivains et leur travail à travers des décisions répétées et intentionnelles de voler des livres plutôt que de les payer en sachant parfaitement que leurs produits détruiront la carrière des auteurs".

Il est important de noter qu’il s’agit d’allégations avancées par les plaignants dans une requête et non de conclusions de fait du tribunal. OpenAI et Microsoft ont toujours soutenu que la formation de grands modèles de langage sur du matériel protégé par le droit d'auteur constitue une utilisation équitable, une défense que l'administration Trump a déjà soutenue dans une déclaration d'intérêt déposée dans une affaire distincte intentée par le New York Times.

Qui poursuit

La liste des plaignants se lit comme un who's who des lettres américaines : la Guilde des auteurs est rejointe par des écrivains dont David Baldacci, Taylor Branch, Michael Connelly, Sylvia Day, Jonathan Franzen, Christopher Golden, Andrew Sean Greer, John Grisham, David Henry Hwang, Matthew Klam, George R.R. Martin, Jodi Picoult, Stacy Schiff et James Shapiro, entre autres.

Le recours collectif, connu sous le nom d'Alter v. OpenAI et Microsoft, est dirigé par l'avocat Justin A. Nelson du cabinet Susman Godfrey. Cela fait partie d'un litige multidistrict plus large contre les deux sociétés en cours devant le tribunal fédéral de Manhattan, où un nombre croissant d'affaires de droit d'auteur contre les développeurs d'IA a été consolidé.

Le chemin procédural à venir

Les documents nouvellement publics sont tirés de deux dépôts : le mémorandum de droit des demandeurs du groupe à l'appui de la requête en jugement sommaire partiel (dossier 1982) et la règle 56.1 corrigée des demandeurs du groupe, déclaration des faits importants incontestés (dossier 1987). En termes simples, les auteurs demandent au tribunal de se prononcer sur des questions fondamentales de responsabilité sans procès complet, arguant que le dossier factuel est déjà incontesté.

La Guilde des auteurs dit qu'elle s'attend à des informations supplémentaires au cours des prochains mois, avec une audience prévue au début de 2027. Ce calendrier en fait l'une des affaires de droit d'auteur sur l'IA les plus importantes à surveiller l'année prochaine, aux côtés de poursuites similaires intentées par des agences de presse, des éditeurs de musique et des artistes visuels.

Parallèlement au mémoire des auteurs, la déclaration de la guilde fait référence à ce qu'elle appelle « des révélations tout aussi torrides mais distinctes » dans un dossier soumis par des organismes de médias avec leurs propres réclamations en matière de droits d'auteur contre les sociétés.

Pourquoi les enjeux sont si élevés

L’issue du cas des auteurs pourrait remodeler l’économie de l’ensemble du secteur de l’IA générative. Si le tribunal rejette la défense d’utilisation équitable et conclut que la formation sur des livres piratés constitue une contrefaçon, OpenAI et Microsoft pourraient faire face à des dommages proportionnels au nombre d’œuvres impliquées – et chaque formation de laboratoire d’IA sur des livres récupérés serait confrontée à une exposition similaire.

En revanche, une décision favorable aux défendeurs consoliderait le fondement juridique sur lequel la plupart des modèles frontaliers ont été construits. Quoi qu'il en soit, les dossiers non scellés ont donné au public un aperçu rare de la façon dont les produits les plus précieux de l'industrie ont été réellement fabriqués – et les plaignants espèrent que le jugement final d'un jury sera de savoir si ce processus était légal.

Pour les écrivains en activité, l’affaire ne se limite pas aux arriérés de salaire. La guilde affirme que les substituts générés par l’IA diminuent déjà la demande d’auteurs humains, une affirmation qui considère le litige comme existentiel pour l’écosystème de l’édition plutôt que comme simplement compensatoire.

OpenAI et Microsoft devraient répondre à la requête en jugement sommaire dans les semaines à venir. En attendant, les citations explosives restent des allégations – mais des allégations qui se trouvent désormais dans un dossier public du tribunal, où elles ancreront l’argument à chaque fois que cette affaire se rapproche du procès.

Gardez une longueur d'avance sur l'IA

Suivez AI Buzz Wire pour connaître les derniers développements en matière d'IA.

Lire plus d'actualités sur l'IA →