Google a publié Lyria 3.5, la dernière version de son modèle de génération de musique AI, directement dans l'application Gemini et via son API de développeur, a annoncé la société ce week-end. Le déploiement place la génération de texte en musique devant l'énorme base d'utilisateurs de Gemini et donne aux développeurs un accès programmatique au modèle pour la première fois de cette génération.

Le lancement a été rapporté par The Decoder et d'autres médias, qui ont noté que Google positionne Lyria 3.5 comme son modèle musical le plus performant à ce jour, avec de meilleures voix et des arrangements plus complets que son prédécesseur. C'est également le dernier signe que la course aux outils d'IA s'étend désormais directement aux médias créatifs – quelque chose que nous suivons de près dans notre couverture sur les outils d'IA.

Ce que Lyria 3.5 peut faire

Selon Google, Lyria 3.5 offre des voix plus expressives et des arrangements musicaux plus riches que la version qu'elle remplace. Les utilisateurs peuvent choisir un genre et un style dans l'application Gemini, choisir entre des voix et des instrumentaux et générer des pistes allant de courts clips à des morceaux de musique plus longs.

Google a également ajouté des modèles conçus pour aider les nouveaux arrivants à démarrer, notamment des préréglages pour la musique de fond et des chansons d'anniversaire personnalisées – signe que l'entreprise s'adresse autant aux utilisateurs occasionnels et aux célébrations qu'aux musiciens. Le pitch est familier des autres fonctionnalités Gemini de Google : abaissez la barrière jusqu'à ce que n'importe qui puisse produire un artefact fini à partir d'une phrase ou deux de description.

Le flux de travail reflète cette simplicité. Un utilisateur décrit le type de piste qu'il souhaite, sélectionne les paramètres de genre et de style et décide si la sortie doit contenir des voix ou rester instrumentale. Étant donné que le modèle gère à la fois les phrases courtes et les compositions plus longues, le même outil couvre un message d'anniversaire, un lit de podcast ou une bande sonore pour une vidéo personnelle – des cas d'utilisation qui nécessitaient auparavant soit un abonnement à de la musique d'archives, soit un compositeur embauché.

Où le modèle est disponible

Le déploiement va au-delà de l'application Gemini. Selon l'annonce de Google, Lyria 3.5 est également disponible dans Google Flow Music avec des fonctionnalités supplémentaires, dans Google AI Studio pour les développeurs et dans Google Vids, l'outil de création vidéo alimenté par l'IA de la société. L'accès à l'API signifie que les applications tierces peuvent s'appuyer directement sur le modèle, ce qui pourrait générer une vague de fonctionnalités musicales dans les applications tierces dans les mois à venir.

Cette largeur compte. L'intégration d'un modèle musical dans un assistant grand public, une plate-forme de développement et un éditeur vidéo offre à Google plusieurs surfaces où l'audio généré devient une option créative par défaut plutôt qu'une nouveauté autonome.

Pour les développeurs, l’accès à AI Studio est l’élément notable. Cela fait passer Lyria d'une curiosité de consommateur à un élément de base : les applications de fitness pourraient générer de la musique d'entraînement adaptative, les studios de jeux pourraient noter les niveaux de manière procédurale et les outils éducatifs pourraient produire des chansons personnalisées pour les cours. Google n'a pas annoncé le prix de l'API dans les documents rapportés jusqu'à présent, il reste donc à voir comment le modèle est mesuré - mais la disponibilité à elle seule indique que la société souhaite que Lyria 3.5 soit intégrée dans l'économie des applications plus large, et non limitée à ses propres produits.

Le pitch de formation agréée

La partie la plus pointue de l'annonce de Google concerne les données d'entraînement. Google affirme que le modèle Lyria a été formé uniquement sur du contenu sous licence – un contraste explicite avec Suno, la startup musicale IA dont les pratiques de formation ont donné lieu à des litiges en matière de droits d'auteur, notamment un procès allemand historique intenté par le groupe de droits musicaux GEMA que Suno a perdu plus tôt cette année.

Google n'a pas partagé de détails sur les données de formation réellement utilisées, comme l'a noté The Decoder. Mais le cadrage du contenu sous licence trace une ligne claire dans un secteur où la provenance des données de formation devient un différenciateur juridique et commercial. Pour les détenteurs de droits, un laboratoire majeur revendiquant une formation entièrement sous licence place la barre plus haut pour les concurrents ; pour les utilisateurs professionnels, cela réduit au moins une partie du risque juridique qui a fait de l’audio généré par l’IA un atout considérable dans la publicité et la production médiatique.

Un marché encombré et litigieux

La génération musicale IA est en train de devenir l’un des domaines les plus contestés des médias génératifs. La défaite de Suno devant la justice allemande sur les questions de droits d'auteur a indiqué que l'environnement juridique pour les modèles formés sur des enregistrements protégés se durcit, en particulier en Europe. Dans ce contexte, la décision de Google de mettre l'accent sur les licences – tout en gardant les détails confidentiels – se lit à la fois comme un bouclier juridique et un message marketing destiné aux entreprises clientes prudentes.

Les enjeux concurrentiels concernent aussi la distribution. La base d'utilisateurs de Gemini donne à Lyria 3.5 une portée que les startups musicales autonomes ont du mal à égaler, et l'intégration dans Google Vids signifie que les bandes sonores d'IA pourraient devenir un élément standard de la création vidéo sur le lieu de travail presque du jour au lendemain.

Ce que cela signifie pour les créateurs

Pour les musiciens en activité, l’arrivée d’un modèle musical raffiné et sous licence dans un assistant grand public est une évolution à double tranchant. Cela réduit à presque zéro le coût des jingles, des pistes d’accompagnement et des chansons personnalisées, tout en soulevant des questions familières sur la manière dont les artistes humains rivalisent avec une production instantanée et adéquate. Pour l'instant, la messagerie de Google se concentre sur l'assistance et la créativité à l'échelle de la célébration plutôt que sur le remplacement de la production en studio.

Ce qui est clair, c’est que la musique IA sort de la phase de démonstration. Avec Lyria 3.5 intégré à l'application Gemini, Flow Music, AI Studio, Google Vids et une API publique, la génération d'une chanson utilisable est désormais une fonctionnalité et non une catégorie de produits en soi - et l'industrie surveillera si la demande de formation sous licence résiste à un examen minutieux.

Gardez une longueur d'avance sur l'IA

Le paysage des outils d’IA change quotidiennement. Obtenez les derniers développements de l'IA en un seul endroit.

Lire plus d'actualités sur l'IA →