News Corp a intensifié sa guerre juridique contre l'utilisation non autorisée de son journalisme en intentant une contre-action contre Brave, le moteur de recherche axé sur la confidentialité, alléguant que l'entreprise avait supprimé des articles protégés par le droit d'auteur pour alimenter des modèles d'IA dans ce que le conglomérat médiatique appelle ** « vol flagrant ».
Reuters a rapporté mercredi que la contre-action avait été déposée dans le cadre d'un litige juridique en cours entre les deux sociétés. News Corp allègue que Brave a systématiquement collecté des articles de ses publications, notamment The Wall Street Journal, The New York Post, The Times de Londres et d'autres grands médias, sans autorisation ni compensation. Pour plus de contexte sur cette histoire, consultez notre tendances IA.Les allégations contre Brave
Selon les documents déposés, Brave a supprimé les articles de News Corp et les a mis à la disposition de tiers à des fins de formation en IA. L'entreprise de médias affirme que cela constitue une violation directe du droit d'auteur, dans la mesure où le contenu a été copié, stocké et redistribué sans l'autorisation des titulaires des droits.
L'utilisation par News Corp de l'expression « vol flagrant » souligne la sévérité avec laquelle elle considère la conduite présumée. L’entreprise s’est positionnée comme l’un des défenseurs les plus agressifs des droits des éditeurs à l’ère de l’IA, ayant déjà engagé des poursuites judiciaires contre plusieurs entreprises technologiques concernant l’utilisation de son contenu.
Brave, fondée par le créateur de JavaScript Brendan Eich, se présente comme une alternative à la recherche Google axée sur la confidentialité. La société exploite un index de recherche construit à l'aide de son propre robot d'exploration, qui a déjà attiré l'attention des éditeurs qui affirment que leur contenu est indexé et réutilisé sans consentement.
Un champ de bataille plus large en matière de droits d'auteur
La contre-action de Brave est la dernière salve dans un conflit juridique tentaculaire entre les éditeurs traditionnels et les sociétés d’IA. Au cours des deux dernières années, de nombreuses organisations médiatiques ont intenté des poursuites, alléguant que leur contenu avait été supprimé sans autorisation pour former de grands modèles de langage et d'autres systèmes d'IA.
Le New York Times a poursuivi OpenAI et Microsoft fin 2023, une affaire qui reste en litige. Des centaines de journaux locaux ont intenté une action commune en matière de droits d'auteur contre les mêmes sociétés. La Guilde des auteurs et des auteurs individuels ont intenté des actions en justice distinctes contre des sociétés d'IA concernant l'utilisation de livres dans les données de formation.
News Corp a été à l’avant-garde de ce combat. La société avait précédemment conclu un accord de licence avec OpenAI d'une valeur de plusieurs dizaines de millions de dollars, démontrant sa stratégie consistant à poursuivre à la fois des litiges et des accords commerciaux. La contre-action de Brave suggère que News Corp étend désormais ses efforts d’application au-delà des plus grandes sociétés d’IA pour inclure des intermédiaires qui facilitent la collecte de données.
Le problème intermédiaire
L’affaire contre Brave soulève une question juridique importante que les tribunaux n’ont pas encore entièrement résolue : si les moteurs de recherche et les agrégateurs de données qui explorent le Web peuvent être tenus responsables lorsque le contenu qu’ils collectent est ensuite utilisé pour la formation à l’IA.
Les moteurs de recherche comme Google fonctionnent depuis longtemps selon le principe selon lequel l’indexation des pages Web pour les résultats de recherche constitue une utilisation équitable. Cependant, le paysage a radicalement changé avec l’essor de l’IA générative. Lorsque l’index d’un moteur de recherche est réutilisé pour former des modèles capables de générer du contenu concurrent, la défense de l’utilisation équitable devient beaucoup moins claire.
L'index de recherche de Brave, construit à l'aide de son robot propriétaire, occupe une zone grise dans ce débat. La société a fait valoir que ses pratiques d’exploration sont standard pour les moteurs de recherche. News Corp affirme que la réutilisation du contenu récupéré pour la formation en IA va bien au-delà de ce qui est nécessaire pour la fonctionnalité de recherche.
Implications pour l'écosystème du Web Scraping
Si News Corp l’emporte, l’affaire pourrait avoir des implications considérables pour l’écosystème de web scraping qui sous-tend une grande partie de l’industrie de l’IA. De nombreuses entreprises d’IA s’appuient sur des courtiers de données, des index de recherche et des robots d’exploration automatisés pour collecter les grandes quantités de texte nécessaires à l’entraînement de leurs modèles. Une décision qui engagerait la responsabilité de ces intermédiaires pourrait perturber les chaînes d’approvisionnement dans l’ensemble du secteur.
À l’inverse, une décision en faveur de Brave renforcerait la position des moteurs de recherche et des agrégateurs de données, rendant plus difficile pour les éditeurs de contrôler la manière dont leur contenu est utilisé une fois qu’il apparaît sur le Web ouvert.
Les experts juridiques notent que le résultat peut dépendre de détails techniques spécifiques sur le fonctionnement du robot d'exploration de Brave, les données collectées et la manière dont elles ont été mises à la disposition des développeurs d'IA. La distinction entre l’indexation des résultats de recherche et la récolte de données pour l’entraînement des modèles pourrait s’avérer décisive.
Les enjeux du journalisme
Pour News Corp et d’autres éditeurs, l’affaire ne concerne pas qu’un seul moteur de recherche. La société a fait valoir que la suppression incontrôlée du journalisme menace les fondements économiques des agences de presse. Si les systèmes d’IA peuvent générer du contenu à partir de matériel récupéré des médias sans compensation, les éditeurs perdent à la fois des lecteurs et les revenus publicitaires qui soutiennent leurs opérations.
L’administration Trump a envoyé des signaux mitigés sur cette question. Alors que certains responsables ont exprimé leur sympathie pour les préoccupations des éditeurs, d'autres ont fait pression en faveur de politiques donnant la priorité au développement de l'IA plutôt qu'au respect des droits d'auteur. La résolution de cas comme News Corp c. Brave peut en fin de compte dépendre de la manière dont les tribunaux interprètent les lois existantes sur le droit d'auteur dans le contexte d'une industrie qui n'existait pas lorsque ces lois ont été rédigées.
Pour l’instant, la contre-action envoie un message clair : News Corp a l’intention d’exploiter toutes les voies disponibles pour protéger son contenu, depuis les plus grands laboratoires d’IA jusqu’aux moteurs de recherche qui leur fournissent des données.
---
Restez à la Pointe de l'IALes dernières actualités, analyses et percées en IA — au même endroit.
Lire plus d'actualités IA →

