Google har släppt Lyria 3.5, den senaste versionen av sin AI-musikgenerationsmodell, direkt inuti Gemini-appen och genom sitt utvecklar-API, meddelade företaget i helgen. Utrullningen sätter text-till-musikgenerering framför Geminis enorma användarbas och ger utvecklare programmatisk tillgång till modellen för första gången i denna generation.
Lanseringen rapporterades av The Decoder och andra butiker, som noterade att Google positionerar Lyria 3.5 som sin mest kapabla musikmodell hittills, med bättre sång och fylligare arrangemang än sin föregångare. Det är också det senaste tecknet på att AI-verktygstävlingen nu går rakt igenom kreativa medier – något vi följer noga i vår AI-verktygsbevakning.
Vad Lyria 3.5 kan göra
Enligt Google levererar Lyria 3.5 mer uttrycksfull sång och rikare musikarrangemang än den version den ersätter. Användare kan välja genre och stil i Gemini-appen, välja mellan sång och instrumental och skapa spår som sträcker sig från korta klipp till längre musikstycken.
Google har också lagt till mallar utformade för att hjälpa nykomlingar komma igång, inklusive förinställningar för bakgrundsmusik och personliga födelsedagssånger – ett tecken på att företaget siktar lika mycket på tillfälliga användare och fester som på musiker. Tonhöjden är bekant från Googles andra Gemini-funktioner: sänk barriären tills vem som helst kan producera en färdig artefakt från en mening eller två av beskrivningen.
Arbetsflödet speglar den enkelheten. En användare beskriver vilken typ av spår de vill ha, väljer genre- och stilparametrar och bestämmer om utgången ska innehålla sång eller förbli instrumental. Eftersom modellen hanterar både korta stings och längre kompositioner, täcker samma verktyg ett födelsedagsmeddelande, en podcastsäng eller ett soundtrack för en hemmavideo - användningsfall som tidigare krävde antingen en stockmusikprenumeration eller en anlitad kompositör.
Där modellen är tillgänglig
Utrullningen går utöver Gemini-appen. Enligt Googles tillkännagivande är Lyria 3.5 även tillgänglig i Google Flow Music med tillagda funktioner, i Google AI Studio för utvecklare och i Google Vids, företagets AI-drivna videoskapande verktyg. API-åtkomst innebär att tredjepartsapplikationer kan bygga vidare på modellen direkt, vilket kan skapa en våg av musikdrivna funktioner i tredjepartsappar under de kommande månaderna.
Den bredden spelar roll. Genom att bädda in en musikmodell över en konsumentassistent, en utvecklarplattform och en videoredigerare får Google flera ytor där genererat ljud blir ett kreativt standardalternativ snarare än en fristående nyhet.
För utvecklare är AI Studio-åtkomst den anmärkningsvärda biten. Det flyttar Lyria från en konsumentnyfikenhet till en byggsten: fitnessappar kan generera adaptiv träningsmusik, spelstudior kan göra nivåer procedurmässigt och utbildningsverktyg kan producera anpassade låtar för lektioner. Google har inte tillkännagett API-prissättning i de material som rapporterats hittills, så hur modellen mäts återstår att se - men endast tillgängligheten signalerar att företaget vill ha Lyria 3.5 inbäddad i den bredare appekonomin, inte begränsad till sina egna produkter.
Licensierad utbildning
Den mest spetsiga delen av Googles tillkännagivande gäller träningsdata. Google säger att Lyria-modellen endast tränades på licensierat innehåll – en explicit kontrast till Suno, AI-musikstartupen vars träningsmetoder har lett till upphovsrättstvister, inklusive en landmärke tysk rättegång väckt av musikrättighetsgruppen GEMA som Suno förlorade tidigare i år.
Google har inte delat med sig av detaljer om vilken träningsdata den faktiskt använde, som The Decoder noterade. Men inramningen av licensierat innehåll drar en tydlig linje i en bransch där utbildningsdatas ursprung håller på att bli en juridisk och kommersiell skillnad. För rättighetsinnehavare höjer ett stort labb som hävdar fullständigt licensierad utbildning ribban för konkurrenter; för företagsanvändare minskar det åtminstone en del av den juridiska risken som har gjort AI-genererat ljud till en stor tillgång inom reklam och medieproduktion.
En trång, rättstvist marknad
AI-musikgenerering håller på att bli ett av de mer omtvistade hörnen av generativ media. Sunos tyska domstolsnederlag över upphovsrättsfrågor signalerade att den rättsliga miljön för modeller som tränas på skyddade inspelningar hårdnar, särskilt i Europa. Mot den bakgrunden läses Googles beslut att betona licensiering – samtidigt som detaljerna är konfidentiella – som både en juridisk sköld och ett marknadsföringsbudskap riktat till försiktiga företagskunder.
Konkurrensinsatserna handlar också om distribution. Geminis användarbas ger Lyria 3.5 räckvidd som fristående musikstartuper kämpar för att matcha, och integrering i Google Vids innebär att AI-ljudspår kan bli en standarddel av videoskapandet på arbetsplatsen nästan över en natt.
Vad det betyder för skapare
För arbetande musiker är ankomsten av en polerad musikmodell med licensierad data inuti en mainstream-assistent en tveeglad utveckling. Det sänker kostnaderna för jinglar, bakgrundsspår och personliga låtar till nästan noll, samtidigt som det väcker välbekanta frågor om hur mänskliga artister konkurrerar med omedelbar, adekvat produktion. För närvarande fokuserar Googles meddelanden på hjälp och kreativitet i festskala snarare än att ersätta studioproduktion.
Det som är tydligt är att AI-musiken håller på att gå ut ur demofasen. Med Lyria 3.5 som finns i Gemini-appen, Flow Music, AI Studio, Google Vids och ett offentligt API, är generering av en användbar låt nu en funktion, inte en egen produktkategori – och branschen kommer att se om det licensierade utbildningsanspråket håller för granskning.
Ligg före AI
AI-verktygslandskapet förändras dagligen. Få den senaste AI-utvecklingen på ett ställe.
Läs mer AI-nyheter →