Společnost Google vydala Lyria 3.5, nejnovější verzi svého modelu hudební generace AI, přímo v aplikaci Gemini a prostřednictvím svého vývojářského API, oznámila společnost tento víkend. Uvedení staví generaci textu na hudbu před obrovskou uživatelskou základnu Gemini a poprvé v této generaci poskytuje vývojářům programový přístup k modelu.

Spuštění bylo oznámeno The Decoder a další prodejny, které poznamenaly, že Google staví Lyrii 3.5 jako svůj dosud nejschopnější hudební model s lepšími vokály a plnějšími aranžemi než jeho předchůdce. Je to také nejnovější známka toho, že závody o nástroje AI nyní běží přímo prostřednictvím kreativních médií – něco, co pozorně sledujeme v našem pokrytí nástrojů AI.

Co dokáže Lyria 3.5

Podle Googlu přináší Lyria 3.5 výraznější vokály a bohatší hudební aranžmá než verze, kterou nahrazuje. Uživatelé si mohou v aplikaci Gemini vybrat žánr a styl, vybrat si mezi vokály a instrumentálními skladbami a generovat skladby od krátkých klipů po delší hudební skladby.

Google také přidal šablony navržené tak, aby pomohly nováčkům začít, včetně předvoleb pro hudbu na pozadí a personalizovaných narozeninových písní – což je známka toho, že se společnost zaměřuje na příležitostné uživatele a oslavy stejně jako na hudebníky. Rozteč je známá z dalších funkcí Gemini od Googlu: snižte bariéru, dokud kdokoli nevyrobí hotový artefakt z jedné nebo dvou vět popisu.

Pracovní postup odráží tuto jednoduchost. Uživatel popíše druh stopy, kterou chce, vybere parametry žánru a stylu a rozhodne se, zda má výstup nést vokály nebo zůstat instrumentální. Vzhledem k tomu, že model zvládá jak krátká žihadla, tak delší skladby, stejný nástroj pokrývá narozeninovou zprávu, podcastovou postel nebo soundtrack pro domácí video – případy použití, které dříve vyžadovaly buď předplatné skladové hudby, nebo najatého skladatele.

Kde je model dostupný

Zavedení přesahuje aplikaci Gemini. Podle oznámení společnosti Google je Lyria 3.5 k dispozici také ve službě Google Flow Music s přidanými funkcemi, v Google AI Studio pro vývojáře a v Google Vids, firemním nástroji pro tvorbu videí s umělou inteligencí. Přístup k rozhraní API znamená, že aplikace třetích stran mohou stavět na modelu přímo, což by v nadcházejících měsících mohlo v aplikacích třetích stran zasadit vlnu funkcí poháněných hudbou.

Na té šíři záleží. Začlenění hudebního modelu do spotřebitelského asistenta, vývojářské platformy a editoru videa dává Googlu více ploch, kde se generovaný zvuk stává výchozí kreativní možností, nikoli samostatnou novinkou.

Pro vývojáře je pozoruhodným kouskem přístup AI Studio. Posouvá Lyrii ze spotřebitelské kuriozity na stavební kámen: fitness aplikace by mohly generovat adaptivní cvičební hudbu, herní studia by mohla hodnotit úrovně procedurálně a vzdělávací nástroje by mohly vytvářet vlastní písně pro lekce. Google neoznámil ceny API v dosud nahlášených materiálech, takže se ještě uvidí, jak je model měřen – ale samotná dostupnost signalizuje, že společnost chce, aby Lyria 3.5 byla začleněna do širší ekonomiky aplikací, nikoli omezena na své vlastní produkty.

Licenční školení

Nejvýraznější část oznámení Google se týká tréninkových dat. Google říká, že model Lyria byl trénován pouze na licencovaném obsahu – což je výslovný kontrast se Suno, hudebním startupem AI, jehož školicí praktiky vedly k soudním sporům o porušení autorských práv, včetně významného německého soudního sporu vzneseného skupinou GEMA na ochranu hudebních práv, který Suno na začátku tohoto roku prohrál.

Google nesdělil podrobnosti o tom, jaká tréninková data skutečně používal, jak poznamenal The Decoder. Rámování licencovaného obsahu však vytyčuje jasnou linii v odvětví, kde se původ školicích dat stává právním a komerčním rozdílem. Pokud jde o držitele práv, velká laboratoř prohlašující plně licencované školení zvyšuje laťku pro konkurenty; pro podnikové uživatele snižuje alespoň část právního rizika, kvůli kterému se zvuk generovaný umělou inteligencí stal velkým aktivem v reklamě a produkci médií.

Přeplněný, sporný trh

Hudební generace AI se stává jedním z nejspornějších koutů generativních médií. Porážka německého soudu Suno kvůli otázkám autorských práv signalizovala, že právní prostředí pro modely trénované na chráněných nahrávkách se přitvrzuje, zejména v Evropě. V této souvislosti se rozhodnutí společnosti Google zdůraznit licencování – při zachování důvěrnosti podrobností – čte jak jako právní štít, tak jako marketingová zpráva zaměřená na opatrné podnikové zákazníky.

Konkurenční sázky jsou také o distribuci. Uživatelská základna Gemini poskytuje Lyrii 3.5 dosah, kterému se samostatné hudební startupy jen těžko vyrovnají, a integrace do Google Vids znamená, že zvukové stopy AI by se mohly stát standardní součástí tvorby videí na pracovišti téměř přes noc.

Co to znamená pro tvůrce

Pro pracující hudebníky je příchod leštěného hudebního modelu s licencovanými daty do mainstreamového asistenta dvojsečným vývojem. Snižuje náklady na znělky, doprovodné skladby a personalizované písně téměř na nulu a zároveň vyvolává známé otázky o tom, jak lidští umělci soutěží s okamžitým, adekvátním výstupem. Zasílání zpráv Google se prozatím soustředí na pomoc a kreativitu na úrovni oslav, spíše než na nahrazování studiové produkce.

Jasné je, že AI hudba přechází z demo fáze. S Lyrií 3.5, která žije v aplikaci Gemini, Flow Music, AI Studio, Google Vids a veřejném rozhraní API, je generování použitelné skladby nyní funkcí, nikoli vlastní kategorií produktů – a průmysl bude sledovat, zda tvrzení o licencovaném školení obstojí při kontrole.

Udržujte si náskok před AI

Krajina nástrojů AI se denně mění. Získejte [nejnovější vývoj AI] (https://aibuzzwire.news) na jednom místě.

Přečtěte si další zprávy o AI →