Sony Music a Universal Music Group podaly další žalobu proti hudebnímu generátoru AI Suno a tentokrát vydavatelství vznáší neobvyklé obvinění: „praní modelů“. Stížnost sdílená s The Verge tvrdí, že nový model Suno v6 je stále postaven na jejich nahrávkách chráněných autorskými právy – i když na nich samotná v6 nikdy nebyla přímo trénována.
Argument 'modelové praní'
Jádrem sporu je tvrzení Suna, že v6 představuje čistý zlom od dřívějších modelů. Označení tvrdí opak: že školení nového modelu na výstupech modelu porušujícího autorská práva neodstraňuje porušení, ale pere jej. For more context on this story, see our ongoing AI news.
„Trénink ‚nového‘ modelu na výstupech modelu porušujícího autorská práva neodstraňuje porušení, ale pere jej, předává hodnotu vyjádření žalobců ze zkopírovaných nahrávek do poškozených modelů, z těchto modelů do jejich výstupů a z těchto výstupů do v6,“ uvádí se ve stížnosti. "V6 není nový začátek; je to ovoce stejného otráveného stromu."
Podle vydavatelství byly dřívější modely Suno trénovány na nelicencované hudbě vytržené z YouTube a dalších zdrojů a v6 zdědila toto pošpinění, protože byla silně trénována na uživatelských výstupech – písních generovaných těmi dřívějšími, údajně porušujícími systémy.
Sony a Universal jsou v hudebním prostoru umělé inteligence pozoruhodné: na rozdíl od některých svých konkurentů nikdy nepodepsaly licenční smlouvu se společností Suno a společnost tak zůstala bez oprávnění používat jejich katalogy.
Nový Twist: Nároky na destilaci
Stížnost společnosti Sony jde ještě dále a tvrdí, že Suno použil destilaci k trénování v6 – techniky, při které je nový model trénován tak, aby replikoval výstupy stávajících „učitelských“ modelů, spíše než aby se učil z nezpracovaných dat. Pokud byla v6 destilována z předchozích modelů postavených na nahrávkách porušujících autorská práva, tvrdí vydavatelé, nová trénovací data nemění nic na základním porušení.
"Dokonce i model, který není přímo trénován na nahrávkách žalobců, je informován o neautorizovaných kopiích společnosti Suno a má z nich prospěch," uvádí se ve stížnosti. Podle názoru štítků, pokud Suno nezačne skutečně od nuly, jeho modely budou i nadále postaveny na ukradených datech – bez ohledu na to, kolikrát společnost deklaruje nový začátek.
Sunova obrana
Suno veřejně tvrdil, že v6 byla postavena jinak. Když byl model uveden na trh, Jack Brody ze Suno řekl The Verge, že byl „vytrénován od základu, s novou sadou dat“, včetně uživatelských dat, ačkoli nenabízel žádné další podrobnosti.
Mluvčí Suno Rachel Racusen později potvrdila, že tréninková data zahrnují „výtvory“ od uživatelů a uvedla, že verze 6 byla vyškolena na „obsah licencovaný našimi partnery, interakce včetně výtvorů a signálů preferencí z naší komunity a nashromážděné poznatky od našeho týmu“. Neupřesnila, zda tato data zahrnovala nahraný zvuk nebo výstupy odvozené z nahraného zvuku – rozdíl v jádru teorie praní značek.
Zvyšující se tlak na AI Music Business
Nová stížnost přispívá k již tak přeplněnému právnímu spisu společnosti Suno. Startup prohrál v srpnu významný německý případ autorských práv s organizací pro kolektivní správu práv GEMA a neochota velkých vydavatelství licencovat své katalogy ponechává základní školicí strategii Suno vystavenou na dvou kontinentech.
Dřívější žaloba vydavatelství v USA proti Suno se zaměřovala na výcvik jejích modelů první generace na jejich nahrávkách. Stížnost v6 účinně uzavírá nejzřejmější únikovou cestu: začít znovu od syntetických dat a uživatelských výtvorů. Pokud je i tato cesta právně poskvrněna, možnosti Suno se zužují na licenční smlouvy podle podmínek vydavatelství, soudní obhajobu svých praktik nebo přestavbu svého tréninkového korpusu z hudby, o které může prokázat, že je licencovaná nebo originální.
Suno není sám, kdo čelí tomuto tlaku. Hudební generátory umělé inteligence, obrazové modely a textové systémy se všechny potýkají se stejnou otázkou, protože raná éra zrušení otevřeného webu ustupuje právnímu zúčtování. Někteří držitelé práv upřednostnili licencování před soudním sporem, stávkující dohody, díky nimž se jejich katalogy proměnily ve školicí vstupy s přidruženou kompenzací. Sony a Universal tím, že dvakrát žalují, sázejí na to, že soudy přinesou lepší výsledek než jakákoli licence.
Na případu také záleží daleko za hranicemi jedné společnosti. Soudy jsou stále častěji žádány, aby rozhodly, zda výstupy umělé inteligence – a modely trénované na výstupech – mohou nést právní zašpinění jejich tréninkových dat. Koncept, který štítky nazývají model laundering, má zjevné paralely v generování textu a obrázků, kde se syntetická data seškrabaná nebo vygenerovaná z dřívějších modelů stávají větším podílem tréninkových sad.
Pokud se teorie Sony a Universalu prosadí, mohla by přetvořit způsob, jakým společnosti s umělou inteligencí přemýšlejí o původu: nejen to, co bylo součástí modelu, ale také to, co bylo součástí modelů, které produkovaly jeho tréninková data. Prozatím se otázka přesouvá k americkému soudu, kde bude muset Suno tvrdit, že v6 je skutečně čistý break, za který se vydává.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →