USA Today Co., Inc. et ses journaux affiliés ont poursuivi OpenAI devant un tribunal fédéral de New York le 8 octobre 2026, alléguant que la société avait entraîné ses modèles GPT sur des centaines de milliers de leurs articles protégés par le droit d'auteur sans autorisation. La poursuite, rapportée pour la première fois par Reuters, demande des dommages-intérêts supérieurs à 250 millions de dollars et ajoute le plus grand nom de l'édition d'informations locales et nationales à la vague de litiges en matière de droits d'auteur contre le fabricant de ChatGPT.
L'affaire, inscrite sous le nom de USA Today Co., Inc. c. OpenAI Foundation devant le tribunal de district américain du district sud de New York, arrive alors que les tribunaux, les régulateurs et les salles de rédaction continuent de se demander comment les systèmes d'IA générative devraient traiter le journalisme protégé par le droit d'auteur. Pour les lecteurs qui suivent les derniers développements de l'IA, la plainte est l'un des actes d'accusation les plus détaillés à ce jour sur la manière dont le corpus de formation d'un laboratoire frontalier a été constitué.
Ce que prétend le procès
Selon des rapports de Reuters, Forbes et Bloomberg Law, la plainte allègue que les grands modèles de langage d'OpenAI ont été formés sur du matériel protégé par le droit d'auteur extrait d'Internet sans autorisation, indépendamment des paywalls ou d'autres restrictions d'accès. Les plaignants allèguent également qu'OpenAI a utilisé des programmes conçus pour supprimer les informations sur la gestion des droits d'auteur, les données de propriété et les droits attachés aux œuvres publiées.
En vertu du cadre légal cité par la plainte, les plaignants peuvent récupérer jusqu'à 150 000 $ pour chaque violation délibérée du droit d'auteur, plus jusqu'à 25 000 $ par violation pour la suppression des informations sur la gestion des droits d'auteur. La poursuite exige un procès devant jury.
Les dépôts, décrits en détail par Unite.AI sur la base du dossier du tribunal, étaient accompagnés d'une exposition d'enregistrements de droits d'auteur et d'une deuxième exposition d'exemples de sortie GPT-5.6. Ces exemples, selon la plainte, montrent que le modèle produit des résumés détaillés en plusieurs sections qui paraphrasent les articles originaux et suivent leur organisation structurelle lorsqu'ils sont invités à rechercher une histoire spécifique par titre.
Les chiffres de la plainte
La plainte indique que le contenu des publications des plaignants comprend plus de 160 000 entrées dans WebText, le corpus interne OpenAI construit pour entraîner GPT-2, dont 83 266 entrées de usatoday.com et 12 994 entrées de freep.com, le domaine Detroit Free Press. Il indique également que les domaines des publications représentent plus de 122 millions de jetons dans C4, un sous-ensemble filtré en langue anglaise d'un instantané de 2019 de l'archive Web Common Crawl.
Pour affirmer qu'OpenAI comprenait ce que contenaient ses modèles, la plainte cite des communications internes. Il indique que le co-fondateur Greg Brockman a déclaré à ses collègues que les modèles étaient particulièrement efficaces pour prédire le texte des articles de presse, et qu'une présentation en 2020 de Dario Amodei, alors responsable de la recherche, a répertorié la génération de nouvelles parmi les compétences de GPT-3. La plainte cite également un vice-président de la recherche d'OpenAI déclarant : « Nous entraînons nos réseaux à mémoriser les données d'entraînement – c'est leur objectif. »
La plainte cite en outre des preuves écrites soumises par OpenAI à une enquête de la Chambre des Lords britannique en décembre 2023, dans lesquelles la société a déclaré que, étant donné que le droit d'auteur couvre pratiquement tous les types d'expression humaine, limiter les données de formation aux œuvres du domaine public ne produirait pas de systèmes d'IA compétitifs.
Rôle présumé de Microsoft
Le dossier englobe également des allégations concernant Microsoft, le partenaire commercial proche d'OpenAI. Selon la plainte, Microsoft a fourni à OpenAI une copie de l'index Bing, une compilation de milliards de pages Web récupérées incluant le contenu des plaignants, dans le cadre d'une initiative nommée Project Taxi sur une période de trois ans. Il allègue en outre que Microsoft a développé et exploité séparément un robot d'exploration appelé Project Mango au nom d'OpenAI, pour lequel OpenAI a payé Microsoft.
La plainte allègue que les filtres de sortie d'OpenAI n'ont pas supprimé le contenu des éditeurs qui n'avaient pas encore poursuivi l'entreprise en justice, une approche qu'un dirigeant de Microsoft aurait décrite en interne en termes peu flatteurs. Les plaignants poursuivent uniquement les entités OpenAI ; Microsoft n'est pas un défendeur désigné dans cette affaire, bien qu'il fasse face à des réclamations similaires dans des poursuites antérieures contre des éditeurs.
Qui poursuit et qui est poursuivi
Les plaignants, tous détenus par USA Today Co., détiennent les droits d'auteur sur le contenu publié par 19 publications, dont USA TODAY, The Tennessean, the Indy Star, The Bergen Record, The Enquirer, Asbury Park Press, the Democrat & Chronicle, The Knoxville News-Sentinel, the Naples Daily News, The Oklahoman, the Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, The Des Moines Register, le Detroit Free Press, le Detroit News, le Palm Beach Post et le Star News. USA Today Co. est l'ancienne Gannett Co., Inc.
Les défendeurs sont sept entités OpenAI, dont la Fondation OpenAI, l'organisation à but non lucratif qui a émergé en détenant des actions dans l'entreprise à but lucratif après la recapitalisation de l'entreprise en octobre 2025, et OpenAI Group PBC, la société d'utilité publique qui héberge désormais les activités commerciales. Les modèles en cause couvrent les versions GPT-1 à GPT-6.1 et GPT-OSS à poids ouvert, y compris toutes les variantes Instant, Thinking, mini, nano et Pro, selon la plainte.
La substitution est la théorie de base
Un thème central de la plainte est la substitution. Les plaignants allèguent qu'OpenAI a post-entraîné ses modèles pour résumer les articles protégés par le droit d'auteur au lieu de renvoyer les articles eux-mêmes, produisant des substituts qui servent le même objectif informatif que les originaux. La plainte cite le responsable de ChatGPT d'OpenAI reconnaissant qu'une fois que le chatbot donne une réponse, il n'y a « aucune bonne raison de cliquer » sur un lien vers la source sous-jacente, et cite la déclaration d'un ingénieur d'OpenAI selon laquelle les utilisateurs ne cliqueront pas sur les liens, quelle que soit leur visibilité.
Cette théorie fait écho aux arguments avancés dans des affaires antérieures. Le New York Times a poursuivi OpenAI et Microsoft en décembre 2023, et des médias comme le Seattle Times et Newsday ont intenté leurs propres poursuites pour atteinte aux droits d'auteur. Une déclaration de lien de parenté déposée dans le cadre de l'action USA Today demande qu'elle soit traitée comme liée au litige consolidé en matière de droits d'auteur d'OpenAI déjà en cours devant le même tribunal.
Pourquoi c'est important
Le résultat des cas consolidés pourrait définir l’économie des résumés d’actualités générés par l’IA pendant des années. Les éditeurs affirment que les réponses des chatbots qui récapitulent leurs rapports détruisent le trafic qui les finance ; Les entreprises d’IA soutiennent que la formation sur des textes accessibles au public constitue une utilisation équitable transformatrice. OpenAI n'a pas encore répondu publiquement à la plainte d'USA Today, et des réponses antérieures à des poursuites similaires ont mis l'accent sur les partenariats de licence et contesté la lecture de l'utilisation équitable par les plaignants.
Pour une couverture continue de cette affaire et des dernières nouvelles sur l'IA qui façonnent l'industrie, restez à l'écoute pendant que le litige se déroule dans le district sud de New York.
---
Gardez une longueur d'avance sur l'IARecevez les dernières actualités, analyses et avancées en matière d'IA, le tout en un seul endroit.
Lire plus d'actualités sur l'IA →