Googleは、AI音楽生成モデルの最新バージョンであるLyria 3.5を、Geminiアプリ内で直接、開発者APIを通じてリリースしたと同社が今週末発表した。このロールアウトにより、Gemini の巨大なユーザー ベースにテキストから音楽への生成が導入され、開発者はこの世代で初めてプログラムからモデルにアクセスできるようになります。

この発売については The Decoder などの報道機関が報じ、Google が Lyria 3.5 を、前バージョンよりも優れたボーカルと充実したアレンジを備えた、これまでで最も有能な音楽モデルとして位置づけていると指摘しました。これは、AI ツールの競争がクリエイティブ メディア全体に広がっているという最新の兆候でもあります。これについては、AI ツールの報道 で詳しく追跡しています。

Lyria 3.5 でできること

Google によると、Lyria 3.5 は、置き換えられるバージョンよりも表現力豊かなボーカルと豊かな音楽アレンジを提供します。ユーザーは、Gemini アプリでジャンルとスタイルを選択し、ボーカルとインストゥルメンタルのどちらかを選択し、短いクリップから長い音楽までの範囲のトラックを生成できます。

Googleはまた、バックグラウンドミュージックやパーソナライズされた誕生日の歌のプリセットなど、初心者が始めるのに役立つように設計されたテンプレートを追加しました。これは、同社がミュージシャンと同じくらいカジュアルなユーザーやお祝いをターゲットにしていることの表れです。この提案は Google の他の Gemini 機能でよく知られているもので、誰でも 1 ~ 2 文の説明から完成した成果物を作成できるようになるまで障壁を低くします。

ワークフローはそのシンプルさを反映しています。ユーザーは、希望するトラックの種類を説明し、ジャンルとスタイルのパラメーターを選択し、出力にボーカルを含めるか、インストゥルメンタルのままにするかを決定します。このモデルは短い楽曲と長い楽曲の両方を処理できるため、同じツールで誕生日のメッセージ、ポッドキャストのベッド、またはホーム ビデオのサウンドトラックをカバーできます。これまではストック ミュージックのサブスクリプションか作曲家を雇う必要があったユースケースです。

モデルが入手できる場所

この展開は Gemini アプリの枠を超えています。 Googleの発表によると、Lyria 3.5は、追加機能を備えたGoogle Flow Music、開発者向けのGoogle AI Studio、同社のAIを活用したビデオ作成ツールであるGoogle Vidsでも利用可能だという。 API アクセスは、サードパーティ アプリケーションがモデルに直接構築できることを意味し、これにより、今後数か月以内にサードパーティ アプリケーションに音楽を活用した機能の波が生まれる可能性があります。

その広さが重要なのです。コンシューマー アシスタント、開発者プラットフォーム、ビデオ エディターに音楽モデルを埋め込むことで、生成されたオーディオがスタンドアロンの目新しさではなくデフォルトのクリエイティブ オプションとなる複数の面が Google に提供されます。

開発者にとって、AI Studio へのアクセスは注目に値します。これにより、Lyria は消費者の好奇心から構築要素へと移行します。フィットネス アプリは適応性のあるワークアウト音楽を生成でき、ゲーム スタジオは手順に従ってレベルをスコアリングでき、教育ツールはレッスン用のカスタム曲を作成できます。 Googleはこれまで報告された資料の中でAPIの価格を発表していないため、このモデルがどのように計測されるのかはまだ分からないが、可用性だけでも同社がLyria 3.5を自社製品に限定するのではなく、より広範なアプリエコノミーに組み込みたいと考えていることが分かる。

ライセンスを取得したトレーニングのピッチ

Googleの発表の中で最も鋭い部分はトレーニングデータに関するものだ。 Googleは、Lyriaモデルはライセンスされたコンテンツのみでトレーニングされたと述べている。これは、音楽著作権団体GEMAが今年初めに敗訴したドイツでの画期的な訴訟を含め、そのトレーニング実践が著作権訴訟を引き起こしたAI音楽スタートアップのSunoとは明らかに対照的である。

The Decoderが指摘したように、Googleは実際にどのようなトレーニングデータを使用したかについて詳細を明らかにしていない。しかし、トレーニング データの出所が法的および商業的な差別化要因になりつつある業界では、ライセンス付きコンテンツの枠組みは明確な一線を画しています。権利所有者にとって、完全にライセンスを取得したトレーニングを主張する大手ラボは、競合他社のハードルを引き上げます。ビジネス ユーザーにとっては、AI によって生成されたオーディオが広告やメディア制作において危険な資産となっている法的リスクの少なくとも一部が軽減されます。

混雑した訴訟市場

AI による音楽生成は、生成メディアの中でも最も争点となる分野の 1 つになりつつあります。著作権問題をめぐるドイツの法廷でのスノ氏の敗訴は、保護された録音でトレーニングされたモデルに対する法的環境が、特にヨーロッパで厳格化していることを示した。こうした背景を背景に、詳細は機密にしつつもライセンスを重視するというGoogleの決定は、法的な盾であると同時に、慎重な企業顧客に向けたマーケティングメッセージであるとも受け取れる。

競争上の賭けは、分配にも関係します。 Gemini のユーザー ベースにより、スタンドアロンの音楽スタートアップが匹敵するのに苦労している Lyria 3.5 のリーチが得られ、Google Vids への統合により、ほぼ一夜にして AI サウンドトラックが職場のビデオ作成の標準的な部分になる可能性があります。

クリエイターにとっての意味

現役のミュージシャンにとって、主流のアシスタント内に洗練されたライセンスデータ音楽モデルが登場することは、両刃の発展です。これにより、ジングル、バッキング トラック、およびパーソナライズされた曲のコストがほぼゼロに下がりますが、その一方で、人間のアーティストが瞬時の適切な出力でどのように競争するかというよくある疑問が生じます。現時点では、Google のメッセージはスタジオ制作に代わるものではなく、支援とお祝い規模の創造性に重点を置いています。

明らかなことは、AI 音楽はデモ段階から脱却しつつあるということです。 Lyria 3.5 が Gemini アプリ、Flow Music、AI Studio、Google Vids、およびパブリック API 内に組み込まれているため、使用可能な曲の生成は独自の製品カテゴリではなく、機能となっています。業界は、ライセンストレーニングの主張が精査に耐えられるかどうかに注目しています。

AI の先を行く

AI ツールの状況は日々変化します。 最新の AI 開発 を 1 か所で入手できます。

AIニュースをもっと読む→