گوگل لایری 3.5، جدیدترین نسخه از مدل تولید موسیقی هوش مصنوعی خود را مستقیماً در داخل اپلیکیشن Gemini و از طریق API توسعه دهنده خود منتشر کرده است، این شرکت آخر هفته اعلام کرد. انتشار، تولید متن به موسیقی را در مقابل پایگاه عظیم کاربران Gemini قرار می دهد و برای اولین بار در این نسل به توسعه دهندگان امکان دسترسی برنامه ریزی شده به مدل را می دهد.

این راه‌اندازی توسط The Decoder و سایر رسانه‌ها گزارش شد، که اشاره کردند که گوگل Lyria 3.5 را به عنوان قوی‌ترین مدل موسیقی خود با آوازهای بهتر و تنظیم‌های کامل‌تر نسبت به نسخه قبلی خود قرار داده است. همچنین این آخرین نشانه ای است که نشان می دهد مسابقه ابزارهای هوش مصنوعی اکنون مستقیماً از طریق رسانه های خلاق اجرا می شود - چیزی که ما در [پوشش ابزارهای هوش مصنوعی] خود (https://aibuzzwire.news) از نزدیک دنبال می کنیم.

آنچه Lyria 3.5 می تواند انجام دهد

به گفته گوگل، Lyria 3.5 نسبت به نسخه ای که جایگزین شده است، آوازهای گویاتر و تنظیم های موسیقی غنی تری ارائه می دهد. کاربران می توانند ژانر و سبکی را در برنامه Gemini انتخاب کنند، بین آواز و ساز انتخاب کنند، و آهنگ هایی را تولید کنند که از کلیپ های کوتاه تا قطعات طولانی تر موسیقی را شامل می شود.

گوگل همچنین قالب هایی را اضافه کرده است که برای کمک به تازه واردان طراحی شده اند، از جمله از پیش تنظیم ها برای موسیقی پس زمینه و آهنگ های شخصی سازی شده تولد - نشانه این است که هدف این شرکت کاربران عادی و جشن ها به اندازه نوازندگان است. زیر و بم با دیگر ویژگی های Gemini گوگل آشناست: مانع را کاهش دهید تا زمانی که هر کسی بتواند از یک یا دو جمله از توضیحات یک مصنوع کامل تولید کند.

گردش کار منعکس کننده این سادگی است. کاربر نوع آهنگی را که می‌خواهد توصیف می‌کند، پارامترهای سبک و سبک را انتخاب می‌کند و تصمیم می‌گیرد که آیا خروجی باید آواز داشته باشد یا ساز باشد. از آنجایی که این مدل هم آهنگ‌های کوتاه و هم آهنگ‌های طولانی‌تر را اجرا می‌کند، همان ابزار یک پیام تولد، یک تخت پادکست یا یک موسیقی متن برای یک ویدیوی خانگی را پوشش می‌دهد - مواردی که قبلاً به اشتراک موسیقی سهام یا آهنگساز استخدامی نیاز داشت.

جایی که مدل موجود است

عرضه فراتر از برنامه Gemini است. طبق اعلام گوگل، Lyria 3.5 همچنین در Google Flow Music با ویژگی‌های اضافه شده، در Google AI Studio برای توسعه‌دهندگان و در Google Vids، ابزار ساخت ویدیو با هوش مصنوعی این شرکت در دسترس است. دسترسی به API به این معنی است که برنامه‌های شخص ثالث می‌توانند مستقیماً بر روی مدل ساخته شوند، که می‌تواند موجی از ویژگی‌های مبتنی بر موسیقی را در برنامه‌های شخص ثالث در ماه‌های آینده ایجاد کند.

این وسعت مهم است. جاسازی یک مدل موسیقی در میان یک دستیار مصرف‌کننده، یک پلتفرم توسعه‌دهنده و یک ویرایشگر ویدیو به Google چندین سطح می‌دهد که در آن صدای تولید شده به‌جای یک نوآوری مستقل، به یک گزینه خلاقانه پیش‌فرض تبدیل می‌شود.

برای توسعه دهندگان، دسترسی استودیو هوش مصنوعی قطعه قابل توجهی است. لیریا را از کنجکاوی مصرف‌کننده به یک بلوک ساختمانی منتقل می‌کند: اپلیکیشن‌های تناسب اندام می‌توانند موسیقی تمرینی تطبیقی ​​تولید کنند، استودیوهای بازی می‌توانند سطوح را از نظر رویه‌ای کسب کنند، و ابزارهای آموزشی می‌توانند آهنگ‌های سفارشی برای درس‌ها تولید کنند. گوگل قیمت API را در مواد گزارش‌شده تاکنون اعلام نکرده است، بنابراین نحوه اندازه‌گیری مدل هنوز مشخص نیست – اما در دسترس بودن به تنهایی نشان می‌دهد که این شرکت می‌خواهد Lyria 3.5 در اقتصاد برنامه گسترده‌تر تعبیه شود، نه محدود به محصولات خود.

زمین آموزشی دارای مجوز

مهمترین بخش اعلامیه گوگل مربوط به داده های آموزشی است. گوگل می‌گوید که مدل Lyria فقط بر روی محتوای دارای مجوز آموزش داده شده است – در تضاد صریح با Suno، استارت‌آپ موسیقی هوش مصنوعی که شیوه‌های آموزشی آن باعث دعوای حقوق کپی رایت شده است، از جمله یک شکایت مهم آلمانی که توسط گروه حقوق موسیقی GEMA مطرح شد و Suno در اوایل امسال شکست خورد.

همانطور که The Decoder اشاره کرد، گوگل جزئیاتی را در مورد اینکه واقعاً از چه داده های آموزشی استفاده می کند، به اشتراک نمی گذارد. اما چارچوب‌بندی محتوای دارای مجوز، خط روشنی را در صنعتی ترسیم می‌کند که منشأ داده‌های آموزشی در حال تبدیل شدن به یک تمایز قانونی و تجاری است. برای دارندگان حقوق، یک آزمایشگاه بزرگ که ادعا می کند آموزش کاملاً دارای مجوز است، سطح را برای رقبا افزایش می دهد. برای کاربران تجاری، حداقل برخی از خطرات قانونی را کاهش می دهد که صدای تولید شده توسط هوش مصنوعی را به یک دارایی بزرگ در تبلیغات و تولید رسانه تبدیل کرده است.

یک بازار شلوغ و دعوا

تولید موسیقی هوش مصنوعی در حال تبدیل شدن به یکی از بحث برانگیزترین گوشه های رسانه های مولد است. شکست دادگاه آلمانی سونو در مورد مسائل مربوط به کپی رایت نشان داد که محیط قانونی برای مدل هایی که در زمینه ضبط های محافظت شده آموزش دیده اند، به ویژه در اروپا سخت تر می شود. در مقابل این پس‌زمینه، تصمیم Google برای تأکید بر صدور مجوز - در حالی که جزئیات را محرمانه نگه می‌دارد - به عنوان یک سپر قانونی و یک پیام بازاریابی با هدف مشتریان سازمانی محتاط خوانده می‌شود.

خطرات رقابتی نیز در مورد توزیع است. پایگاه کاربری Gemini به Lyria 3.5 دسترسی پیدا می‌کند که استارت‌آپ‌های موسیقی مستقل برای مطابقت با آن تلاش می‌کنند، و ادغام با Google Vids به این معنی است که موسیقی متن‌های هوش مصنوعی می‌تواند تقریباً یک شبه به بخشی استاندارد از ایجاد ویدیو در محل کار تبدیل شود.

چه معنایی برای سازندگان دارد

برای نوازندگان فعال، ورود یک مدل موسیقی صیقلی و دارای داده های مجوز در داخل یک دستیار جریان اصلی یک پیشرفت دو طرفه است. هزینه آهنگ‌های جینگل، آهنگ‌های پشتیبان و آهنگ‌های شخصی‌شده را تقریباً به صفر می‌رساند، در حالی که سؤالات آشنا را در مورد نحوه رقابت هنرمندان انسانی با خروجی فوری و کافی ایجاد می‌کند. در حال حاضر، پیام‌رسانی گوگل به جای جایگزینی تولید استودیویی، بر خلاقیت در مقیاس جشن و کمک متمرکز است.

آنچه واضح است این است که موسیقی هوش مصنوعی از مرحله نمایشی خارج می شود. با توجه به اینکه Lyria 3.5 در برنامه Gemini، Flow Music، AI Studio، Google Vids و یک API عمومی زندگی می‌کند، اکنون تولید یک آهنگ قابل استفاده یک ویژگی است، نه یک دسته محصول خاص خود - و صنعت خواهد دید که آیا ادعای آموزش مجاز مورد بررسی قرار می‌گیرد یا خیر.

از هوش مصنوعی جلوتر بمانید

چشم انداز ابزار هوش مصنوعی هر روز تغییر می کند. [آخرین پیشرفت‌های هوش مصنوعی] (https://aibuzzwire.news) را در یک مکان دریافت کنید.

اخبار هوش مصنوعی را بیشتر بخوانید →