Google випустив Lyria 3.5, найновішу версію своєї моделі генерації музики зі штучним інтелектом, безпосередньо в додатку Gemini та через API розробника, як компанія оголосила цими вихідними. Розгортання ставить створення тексту в музику перед величезною базою користувачів Gemini та надає розробникам програмний доступ до моделі вперше в цьому поколінні.
Про запуск повідомили The Decoder та інші видання, які відзначили, що Google позиціонує Lyria 3.5 як свою найпотужнішу музичну модель з кращим вокалом і повнішим аранжуванням, ніж її попередник. Це також остання ознака того, що гонка інструментів штучного інтелекту тепер проходить прямо через креативні ЗМІ — за чим ми уважно стежимо в нашому [висвітленні інструментів штучного інтелекту] (https://aibuzzwire.news).
Що може Lyria 3.5
За словами Google, Lyria 3.5 забезпечує більш виразний вокал і багатше музичне аранжування, ніж версія, яку вона замінює. Користувачі можуть вибирати жанр і стиль у додатку Gemini, вибирати між вокалом і інструменталом, а також створювати композиції від коротких кліпів до більш довгих музичних творів.
Google також додав шаблони, призначені для того, щоб допомогти новачкам розпочати роботу, включаючи налаштування для фонової музики та персоналізованих пісень на день народження — ознака того, що компанія націлена на випадкових користувачів і святкування так само, як і на музикантів. Подача знайома з інших функцій Gemini від Google: опускайте бар’єр, доки будь-хто не зможе створити готовий артефакт із одного-двох речень опису.
Робочий процес відображає цю простоту. Користувач описує тип треку, який він хоче, вибирає параметри жанру та стилю, а також вирішує, чи повинен вихід містити вокал чи залишатися інструментальним. Оскільки модель обробляє як короткі фрагменти, так і довші композиції, той самий інструмент охоплює повідомлення про день народження, подкаст або звукову доріжку для домашнього відео — випадки використання, які раніше вимагали або підписки на стокову музику, або найнятого композитора.
Де доступна модель
Розгортання виходить за рамки програми Gemini. Згідно з оголошенням Google, Lyria 3.5 також доступна в Google Flow Music з додатковими функціями, в Google AI Studio для розробників і в Google Vids, інструменті компанії для створення відео на основі AI. Доступ до API означає, що програми сторонніх розробників можуть безпосередньо створювати модель, що може спричинити хвилю музичних функцій у програмах сторонніх розробників у найближчі місяці.
Ця ширина має значення. Вбудовування музичної моделі в помічник користувача, платформу розробника та відеоредактор дає Google кілька поверхонь, де згенероване аудіо стає творчим варіантом за умовчанням, а не окремою новинкою.
Для розробників доступ до AI Studio є важливою частиною. Це переміщує Lyria від споживчої цікавості до будівельного блоку: програми для фітнесу можуть створювати адаптивну музику для тренувань, ігрові студії можуть оцінювати рівні процедурно, а освітні інструменти можуть створювати власні пісні для уроків. Google не оголосив ціну API в наданих на даний момент матеріалах, тому ще належить з’ясувати, як модель вимірюється, але сама доступність сигналізує про те, що компанія хоче, щоб Lyria 3.5 була вбудована в ширшу економіку додатків, а не обмежувалася її власними продуктами.
Ліцензована навчальна презентація
Найважливіша частина оголошення Google стосується даних про навчання. У Google стверджують, що модель Lyria навчалася лише на ліцензованому контенті — це явний контраст із Suno, музичним стартапом зі штучним інтелектом, практика навчання якого призвела до судових позовів щодо авторських прав, включаючи знаковий позов у Німеччині, поданий групою прав на музику GEMA, який Suno програв на початку цього року.
Як зазначає The Decoder, Google не поділився конкретними даними щодо тренувань. Але фреймінг ліцензованого вмісту проводить чітку межу в галузі, де походження навчальних даних стає юридичною та комерційною відмінністю. Для власників прав велика лабораторія, яка заявляє про повну ліцензію на навчання, підвищує планку для конкурентів; для бізнес-користувачів це принаймні частково зменшує юридичний ризик, через який аудіо, створене штучним інтелектом, стає небезпечним активом у рекламі та медіа-виробництві.
Переповнений, судовий ринок
Генерація музики ШІ стає одним із найбільш суперечливих куточків генеративних медіа. Поразка Suno в німецькому суді щодо авторських прав свідчить про те, що правове середовище для моделей, які навчаються на захищених записах, стає жорсткішим, особливо в Європі. На цьому тлі рішення Google зробити акцент на ліцензуванні, зберігаючи деталі конфіденційними, сприймається як юридичний щит і маркетингове повідомлення, спрямоване на обережних корпоративних клієнтів.
Конкурентні ставки також стосуються розподілу. База користувачів Gemini дає Lyria 3.5 охоплення, яке важко досягти самостійним музичним стартапам, а інтеграція в Google Vids означає, що звукові доріжки зі штучним інтелектом можуть майже миттєво стати стандартною частиною створення відео на робочому місці.
Що це означає для творців
Для працюючих музикантів поява відшліфованої музичної моделі з ліцензованими даними в стандартному помічнику є подвійною подією. Це знижує вартість джинглів, мінусовок і персоналізованих пісень майже до нуля, водночас піднімаючи знайомі питання про те, як люди-виконавці конкурують із миттєвим відповідним результатом. Наразі система обміну повідомленнями Google зосереджена на допомозі та креативності масштабних свят, а не на заміні студійного виробництва.
Очевидно лише те, що музика штучного інтелекту виходить із фази демонстрації. Завдяки Lyria 3.5, що живе в додатку Gemini, Flow Music, AI Studio, Google Vids і загальнодоступному API, створення придатної для використання пісні тепер є функцією, а не окремою категорією продукту, і індустрія спостерігатиме, чи витримає твердження про ліцензоване навчання.
Будьте попереду ШІ
Ландшафт інструментів ШІ змінюється щодня. Отримуйте останні розробки ШІ в одному місці.
Читати більше новин AI →