Sony Music і Universal Music Group подали ще один позов проти музичного генератора ШІ Suno, і цього разу лейбли висунули незвичайне звинувачення: «відмивання моделей». У скарзі, надісланій The Verge, стверджується, що нова модель Suno v6 все ще побудована на їхніх записах, захищених авторським правом — навіть якщо сам v6 ніколи не навчався безпосередньо на них.

Аргумент «відмивання моделі».

Суть суперечки полягає в заяві Suno про те, що v6 представляє чистий відрив від попередніх моделей. Маркери стверджують протилежне: навчання нової моделі на результатах моделі, що порушує, не усуває порушення, воно відмиває його. For more context on this story, see our ongoing more AI stories.

«Навчання «нової» моделі на виходах порушної моделі не усуває порушення; воно відмиває його, передаючи значення вираження позивачів із скопійованих записів у зіпсовані моделі, з цих моделей у їхні виходи, а з цих виходів у v6», — йдеться у скарзі. «V6 — це не новий початок; це плід того самого отруєного дерева».

Згідно з лейблами, попередні моделі Suno були навчені на неліцензійній музиці, вилученій з YouTube та інших джерел, і v6 успадкував цю пляму, оскільки він був серйозно навчений на вихідних даних користувачів — піснях, створених цими попередніми системами, які ймовірно порушують права.

Sony і Universal є помітними сторонами в музичному просторі ШІ: на відміну від деяких своїх конкурентів, вони ніколи не підписували ліцензійну угоду з Suno, залишаючи компанію без дозволу на використання їхніх каталогів.

Новий поворот: дистиляція

Скарга Sony йде далі, стверджуючи, що Suno використовував дистиляцію для навчання версії 6 — методики, за якої нова модель навчається повторювати результати існуючих моделей «вчителя», а не навчатися на необроблених даних. Якщо версія 6 була виділена з попередніх моделей, створених на записах, що порушують авторські права, стверджують лейбли, нові навчальні дані нічого не змінюють щодо основного порушення.

«Навіть модель, яка не пройшла безпосереднього навчання на записах Позивачів, отримує інформацію з неавторизованих копій, які зберігає Suno», — йдеться у скарзі. На думку лейблів, якщо Suno справді не почне з нуля, її моделі й надалі будуватимуться на основі вкрадених даних — незалежно від того, скільки разів компанія оголошувала про новий початок.

Захист Суно

Suno публічно стверджувала, що v6 було побудовано інакше. Коли модель була запущена, Джек Броуді з Suno сказав The Verge, що її «навчили з нуля, з новим набором даних», включно з даними користувачів, хоча він не надав жодних подробиць, крім цього.

Представник Suno Рейчел Ракузен пізніше підтвердила, що навчальні дані включають «твори» від користувачів, сказавши, що v6 навчався на «контенті, ліцензованому від наших партнерів, взаємодії, включаючи творіння та сигнали переваг від нашої спільноти, а також накопичені знання від нашої команди». Вона не уточнила, чи включали ці дані завантажене аудіо чи вихідні дані, отримані із завантаженого аудіо — відмінність, яка лежить в основі теорії відмивання лейблів.

Зростання тиску на музичний бізнес ШІ

Нова скарга доповнює і без того переповнений судовий список Suno. У серпні стартап програв знакову справу про авторські права в Німеччині товариству GEMA, а через небажання великих лейблів ліцензувати свої каталоги основна стратегія навчання Suno стає відкритою на двох континентах.

Попередній позов лейблів у США проти Suno був спрямований на навчання моделей першого покоління на їхніх записах. Скарга версії 6 фактично закриває найбільш очевидний вихід: почати все заново з синтетичних даних і створених користувачами. Якщо навіть цей шлях є юридично заплямованим, варіанти Suno звужуються до ліцензійних угод на умовах лейблів, захисту своєї практики в судовому залі або перебудови свого навчального корпусу з музики, яка може довести, що вона ліцензована чи оригінальна.

Суно не єдиний, хто зіткнувся з цим тиском. Музичні генератори штучного інтелекту, моделі зображень і текстові системи стикаються з одним і тим же питанням, оскільки рання ера відмови від відкритого Інтернету поступається місцем юридичним розрахункам. Деякі правовласники віддали перевагу ліцензуванню, а не судовому розгляду, укладаючи угоди, які перетворюють їхні каталоги на навчальні матеріали з компенсацією. Sony і Universal, подавши двічі до суду, роблять ставку на те, що суди принесуть кращий результат, ніж будь-яка ліцензія.

Справа також має значення далеко за межами однієї компанії. До судів все частіше звертаються з проханням вирішити, чи можуть результати штучного інтелекту — і моделі, навчені на результатах — мати юридичну пляму їхніх навчальних даних. Концепція, яку ярлики називають відмиванням моделі, має очевидні паралелі в генерації тексту та зображень, де синтетичні дані, зібрані або згенеровані з попередніх моделей, стають більшою частиною навчальних наборів.

Якщо теорія Sony і Universal набуде популярності, це може змінити те, як компанії штучного інтелекту думають про походження: не лише про те, що увійшло в модель, а й про те, що увійшло в моделі, які створювали навчальні дані. Наразі питання переходить до суду США, де Suno доведеться стверджувати, що v6 справді є чистим проривом, яким він претендує.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →