Google lanzó Lyria 3.5, la versión más nueva de su modelo de generación de música con IA, directamente dentro de la aplicación Gemini y a través de su API de desarrollador, anunció la compañía este fin de semana. El lanzamiento coloca la generación de texto a música frente a la enorme base de usuarios de Gemini y brinda a los desarrolladores acceso programático al modelo por primera vez en esta generación.

El lanzamiento fue informado por The Decoder y otros medios, que señalaron que Google está posicionando a Lyria 3.5 como su modelo musical más capaz hasta el momento, con mejores voces y arreglos más completos que su predecesor. También es la última señal de que la carrera por las herramientas de IA ahora pasa directamente por los medios creativos, algo que seguimos de cerca en nuestra cobertura de herramientas de IA.

Qué puede hacer Lyria 3.5

Según Google, Lyria 3.5 ofrece voces más expresivas y arreglos musicales más ricos que la versión a la que reemplaza. Los usuarios pueden elegir un género y estilo en la aplicación Gemini, elegir entre voces e instrumentos y generar pistas que van desde clips cortos hasta piezas musicales más largas.

Google también ha agregado plantillas diseñadas para ayudar a los recién llegados a comenzar, incluidos ajustes preestablecidos para música de fondo y canciones de cumpleaños personalizadas, una señal de que la compañía apunta tanto a usuarios ocasionales y celebraciones como a músicos. El tono es familiar por otras características de Gemini de Google: bajar la barrera hasta que cualquiera pueda producir un artefacto terminado a partir de una o dos oraciones de descripción.

El flujo de trabajo refleja esa simplicidad. Un usuario describe el tipo de pista que desea, selecciona parámetros de género y estilo y decide si la salida debe contener voces o ser instrumental. Debido a que el modelo maneja tanto picaduras cortas como composiciones más largas, la misma herramienta cubre un mensaje de cumpleaños, un podcast o una banda sonora para un video casero, casos de uso que anteriormente requerían una suscripción a música de archivo o un compositor contratado.

Dónde está disponible el modelo

El lanzamiento va más allá de la aplicación Gemini. Según el anuncio de Google, Lyria 3.5 también está disponible en Google Flow Music con funciones adicionales, en Google AI Studio para desarrolladores y en Google Vids, la herramienta de creación de vídeos impulsada por IA de la compañía. El acceso API significa que las aplicaciones de terceros pueden basarse en el modelo directamente, lo que podría generar una ola de funciones basadas en música en aplicaciones de terceros en los próximos meses.

Esa amplitud importa. Integrar un modelo de música en un asistente para el consumidor, una plataforma de desarrollador y un editor de video le brinda a Google múltiples superficies donde el audio generado se convierte en una opción creativa predeterminada en lugar de una novedad independiente.

Para los desarrolladores, el acceso a AI Studio es la pieza destacada. Esto hace que Lyria pase de ser una curiosidad del consumidor a un componente básico: las aplicaciones de fitness podrían generar música de entrenamiento adaptativa, los estudios de juegos podrían puntuar niveles de forma procesal y las herramientas educativas podrían producir canciones personalizadas para las lecciones. Google no ha anunciado el precio de la API en los materiales reportados hasta ahora, por lo que aún está por verse cómo se mide el modelo, pero la disponibilidad por sí sola indica que la compañía quiere que Lyria 3.5 esté integrada en la economía de aplicaciones más amplia, no confinada a sus propios productos.

The Licensed-Training Pitch

La parte más destacada del anuncio de Google se refiere a los datos de entrenamiento. Google dice que el modelo Lyria se entrenó sólo en contenido con licencia, en un contraste explícito con Suno, la startup musical de inteligencia artificial cuyas prácticas de entrenamiento han generado litigios por derechos de autor, incluida una histórica demanda alemana presentada por el grupo de derechos musicales GEMA que Suno perdió a principios de este año.

Google no ha compartido detalles sobre qué datos de entrenamiento utilizó realmente, como señaló The Decoder. Pero el marco del contenido bajo licencia traza una línea clara en una industria donde la procedencia de los datos de capacitación se está convirtiendo en un diferenciador legal y comercial. Para los titulares de derechos, un laboratorio importante que afirma tener formación con licencia completa eleva el listón para los competidores; para los usuarios empresariales, reduce al menos parte del riesgo legal que ha hecho del audio generado por IA un activo complicado en la publicidad y la producción de medios.

Un mercado saturado y litigado

La generación de música mediante IA se está convirtiendo en uno de los rincones más controvertidos de los medios generativos. La derrota de Suno en los tribunales alemanes por cuestiones de derechos de autor señaló que el entorno legal para los modelos entrenados con grabaciones protegidas se está endureciendo, particularmente en Europa. En ese contexto, la decisión de Google de enfatizar las licencias (mientras mantiene la confidencialidad de los detalles) se lee como un escudo legal y un mensaje de marketing dirigido a clientes empresariales cautelosos.

Lo que está en juego en la competencia también tiene que ver con la distribución. La base de usuarios de Gemini le da a Lyria 3.5 un alcance que las nuevas empresas de música independientes luchan por igualar, y la integración en Google Vids significa que las bandas sonoras de IA podrían convertirse en una parte estándar de la creación de videos en el lugar de trabajo casi de la noche a la mañana.

Qué significa para los creadores

Para los músicos que trabajan, la llegada de un modelo musical pulido y con datos bajo licencia dentro de un asistente convencional es un avance de doble filo. Reduce el costo de jingles, pistas de acompañamiento y canciones personalizadas a casi cero, al tiempo que plantea preguntas familiares sobre cómo los artistas humanos compiten con una producción instantánea y adecuada. Por ahora, los mensajes de Google se centran en la asistencia y la creatividad a escala de celebración en lugar de reemplazar la producción de estudio.

Lo que está claro es que la música con IA está saliendo de la fase de demostración. Con Lyria 3.5 dentro de la aplicación Gemini, Flow Music, AI Studio, Google Vids y una API pública, generar una canción utilizable ahora es una característica, no una categoría de producto en sí misma, y ​​la industria observará si la afirmación de capacitación con licencia resiste el escrutinio.

Manténgase por delante de la IA

El panorama de las herramientas de IA cambia a diario. Obtenga los últimos desarrollos de IA en un solo lugar.

Leer más noticias sobre IA →