Корпорація News Corp загострила свою юридичну війну проти несанкціонованого використання її журналістських матеріалів, подавши зустрічний позов проти Brave, пошукової системи, орієнтованої на конфіденційність, стверджуючи, що компанія збирала захищені авторським правом статті, щоб нагодувати моделі штучного інтелекту, у тому, що медіаконгломерат називає "кричущою крадіжкою".

Reuters повідомило в середу, що зустрічний позов було подано у зв’язку з триваючим судовим спором між двома компаніями. News Corp стверджує, що Brave систематично збирав статті зі своїх видань, серед яких The Wall Street Journal, The New York Post, The Times of London та інші великі новинні видання, без дозволу чи компенсації. For more context on this story, see our ongoing AI industry coverage.

Звинувачення проти Brave

Відповідно до документів, Brave збирав статті News Corp і надавав їх третім сторонам для навчання ШІ. Медіакомпанія стверджує, що це є прямим порушенням авторських прав, оскільки контент копіювався, зберігався та розповсюджувався без дозволу правовласників.

Використання News Corp фрази «явна крадіжка» підкреслює суворість, з якою вона розглядає передбачувану поведінку. Компанія позиціонує себе як одного з найагресивніших захисників прав видавців в епоху штучного інтелекту, вже порушивши судові процеси проти кількох технологічних компаній через використання її контенту.

Компанія Brave, заснована творцем JavaScript Бренданом Айхом, рекламує себе як альтернативу Пошуку Google, яка в першу чергу ставиться до конфіденційності. Компанія керує пошуковим індексом, створеним за допомогою власного сканера, який раніше привертав увагу видавців, які стверджували, що їхній вміст індексується та змінюється без згоди.

Ширше поле битви за авторське право

Зустрічний позов Brave — це останній залп у розгалуженому правовому конфлікті між традиційними видавцями та компаніями штучного інтелекту. Протягом останніх двох років численні медіа-організації подали позови, стверджуючи, що їх вміст було зібрано без дозволу для навчання великих мовних моделей та інших систем ШІ.

Наприкінці 2023 року газета New York Times подала до суду на OpenAI і Microsoft, і ця справа продовжує розглядатися. Сотні місцевих газет подали спільний позов щодо авторських прав проти одних і тих же компаній. Гільдія авторів та окремі автори подали окремі судові позови проти фірм ШІ через використання книг у навчальних даних.

News Corp була в авангарді цієї боротьби. Раніше компанія уклала ліцензійну угоду з OpenAI, як повідомляється, на десятки мільйонів доларів, демонструючи свою стратегію проведення як судових процесів, так і комерційних угод. Зустрічний позов від Brave свідчить про те, що News Corp тепер розширює свої зусилля з правозастосування за межі найбільших компаній штучного інтелекту, включивши посередників, які полегшують збір даних.

Проблема посередника

Справа проти Brave піднімає важливе юридичне питання, яке суди ще не повністю вирішили: чи можуть пошукові системи та агрегатори даних, які сканують Інтернет, нести відповідальність, якщо зібраний ними контент згодом використовується для навчання ШІ.

Такі пошукові системи, як Google, уже давно працюють за принципом, що індексація веб-сторінок для результатів пошуку є добросовісним використанням. Однак ландшафт кардинально змінився з появою генеративного ШІ. Коли індекс пошукової системи перепрофільовано для навчання моделей, які можуть генерувати конкуруючий вміст, захист добросовісного використання стає набагато менш зрозумілим.

Пошуковий індекс Brave, створений за допомогою його власного сканера, займає сіру зону в цій дискусії. Компанія стверджувала, що її методи сканування є стандартними для пошукових систем. News Corp стверджує, що перепрофілювання скопійованого вмісту для навчання штучному інтелекту виходить далеко за межі того, що необхідно для функціональності пошуку.

Наслідки для екосистеми Web Scraping

Якщо News Corp переможе, ця справа може мати далекосяжні наслідки для екосистеми веб-скрейпінгу, яка лежить в основі більшості індустрії ШІ. Багато компаній зі штучного інтелекту покладаються на брокерів даних, пошукові індекси та автоматизовані сканери, щоб зібрати величезну кількість тексту, необхідного для навчання своїх моделей. Постанова, яка притягує цих посередників до відповідальності, може порушити ланцюжки поставок у всьому секторі.

Навпаки, рішення на користь Brave зміцнить позиції пошукових систем і агрегаторів даних, що ускладнить видавцям контроль за тим, як використовується їхній контент після того, як він з’явиться у відкритому Інтернеті.

Експерти з права відзначають, що результат може залежати від конкретних технічних деталей про те, як працював сканер Brave, які дані були зібрані та як вони були доступні для розробників ШІ. Різниця між індексуванням результатів пошуку та збором даних для навчання моделі може виявитися вирішальною.

Ставки для журналістики

Для News Corp та інших видавців справа стосується не однієї пошукової системи. Компанія стверджувала, що безконтрольне вичищення журналістики загрожує економічній основі новинних організацій. Якщо системи штучного інтелекту можуть генерувати контент, використовуючи матеріали, зібрані з новинних агентств, без компенсації, видавці втрачають як читачів, так і дохід від реклами, який підтримує їх діяльність.

Адміністрація Трампа надсилає неоднозначні сигнали щодо цього питання. У той час як деякі посадовці висловлювали співчуття щодо стурбованості видавців, інші наполягали на політиках, які віддають перевагу розробці штучного інтелекту над дотриманням авторських прав. Вирішення таких справ, як News Corp проти Brave, зрештою може залежати від того, як суди тлумачать чинне законодавство про авторське право в контексті галузі, якої не існувало, коли ці закони були написані.

Наразі зустрічний позов посилає чітке повідомлення: News Corp має намір використовувати всі доступні засоби для захисту свого контенту, від найбільших лабораторій ШІ до пошукових систем, які передають їм дані.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →