گوگل لایری 3.5، جدیدترین نسخه از مدل تولید موسیقی هوش مصنوعی خود را مستقیماً در داخل اپلیکیشن Gemini و از طریق API توسعه دهنده خود منتشر کرده است، این شرکت آخر هفته اعلام کرد. انتشار، تولید متن به موسیقی را در مقابل پایگاه عظیم کاربران Gemini قرار می دهد و برای اولین بار در این نسل به توسعه دهندگان امکان دسترسی برنامه ریزی شده به مدل را می دهد.
این راهاندازی توسط The Decoder و سایر رسانهها گزارش شد، که اشاره کردند که گوگل Lyria 3.5 را به عنوان قویترین مدل موسیقی خود با آوازهای بهتر و تنظیمهای کاملتر نسبت به نسخه قبلی خود قرار داده است. همچنین این آخرین نشانه ای است که نشان می دهد مسابقه ابزارهای هوش مصنوعی اکنون مستقیماً از طریق رسانه های خلاق اجرا می شود - چیزی که ما در [پوشش ابزارهای هوش مصنوعی] خود (https://aibuzzwire.news) از نزدیک دنبال می کنیم.
آنچه Lyria 3.5 می تواند انجام دهد
به گفته گوگل، Lyria 3.5 نسبت به نسخه ای که جایگزین شده است، آوازهای گویاتر و تنظیم های موسیقی غنی تری ارائه می دهد. کاربران می توانند ژانر و سبکی را در برنامه Gemini انتخاب کنند، بین آواز و ساز انتخاب کنند، و آهنگ هایی را تولید کنند که از کلیپ های کوتاه تا قطعات طولانی تر موسیقی را شامل می شود.
گوگل همچنین قالب هایی را اضافه کرده است که برای کمک به تازه واردان طراحی شده اند، از جمله از پیش تنظیم ها برای موسیقی پس زمینه و آهنگ های شخصی سازی شده تولد - نشانه این است که هدف این شرکت کاربران عادی و جشن ها به اندازه نوازندگان است. زیر و بم با دیگر ویژگی های Gemini گوگل آشناست: مانع را کاهش دهید تا زمانی که هر کسی بتواند از یک یا دو جمله از توضیحات یک مصنوع کامل تولید کند.
گردش کار منعکس کننده این سادگی است. کاربر نوع آهنگی را که میخواهد توصیف میکند، پارامترهای سبک و سبک را انتخاب میکند و تصمیم میگیرد که آیا خروجی باید آواز داشته باشد یا ساز باشد. از آنجایی که این مدل هم آهنگهای کوتاه و هم آهنگهای طولانیتر را اجرا میکند، همان ابزار یک پیام تولد، یک تخت پادکست یا یک موسیقی متن برای یک ویدیوی خانگی را پوشش میدهد - مواردی که قبلاً به اشتراک موسیقی سهام یا آهنگساز استخدامی نیاز داشت.
جایی که مدل موجود است
عرضه فراتر از برنامه Gemini است. طبق اعلام گوگل، Lyria 3.5 همچنین در Google Flow Music با ویژگیهای اضافه شده، در Google AI Studio برای توسعهدهندگان و در Google Vids، ابزار ساخت ویدیو با هوش مصنوعی این شرکت در دسترس است. دسترسی به API به این معنی است که برنامههای شخص ثالث میتوانند مستقیماً بر روی مدل ساخته شوند، که میتواند موجی از ویژگیهای مبتنی بر موسیقی را در برنامههای شخص ثالث در ماههای آینده ایجاد کند.
این وسعت مهم است. جاسازی یک مدل موسیقی در میان یک دستیار مصرفکننده، یک پلتفرم توسعهدهنده و یک ویرایشگر ویدیو به Google چندین سطح میدهد که در آن صدای تولید شده بهجای یک نوآوری مستقل، به یک گزینه خلاقانه پیشفرض تبدیل میشود.
برای توسعه دهندگان، دسترسی استودیو هوش مصنوعی قطعه قابل توجهی است. لیریا را از کنجکاوی مصرفکننده به یک بلوک ساختمانی منتقل میکند: اپلیکیشنهای تناسب اندام میتوانند موسیقی تمرینی تطبیقی تولید کنند، استودیوهای بازی میتوانند سطوح را از نظر رویهای کسب کنند، و ابزارهای آموزشی میتوانند آهنگهای سفارشی برای درسها تولید کنند. گوگل قیمت API را در مواد گزارششده تاکنون اعلام نکرده است، بنابراین نحوه اندازهگیری مدل هنوز مشخص نیست – اما در دسترس بودن به تنهایی نشان میدهد که این شرکت میخواهد Lyria 3.5 در اقتصاد برنامه گستردهتر تعبیه شود، نه محدود به محصولات خود.
زمین آموزشی دارای مجوز
مهمترین بخش اعلامیه گوگل مربوط به داده های آموزشی است. گوگل میگوید که مدل Lyria فقط بر روی محتوای دارای مجوز آموزش داده شده است – در تضاد صریح با Suno، استارتآپ موسیقی هوش مصنوعی که شیوههای آموزشی آن باعث دعوای حقوق کپی رایت شده است، از جمله یک شکایت مهم آلمانی که توسط گروه حقوق موسیقی GEMA مطرح شد و Suno در اوایل امسال شکست خورد.
همانطور که The Decoder اشاره کرد، گوگل جزئیاتی را در مورد اینکه واقعاً از چه داده های آموزشی استفاده می کند، به اشتراک نمی گذارد. اما چارچوببندی محتوای دارای مجوز، خط روشنی را در صنعتی ترسیم میکند که منشأ دادههای آموزشی در حال تبدیل شدن به یک تمایز قانونی و تجاری است. برای دارندگان حقوق، یک آزمایشگاه بزرگ که ادعا می کند آموزش کاملاً دارای مجوز است، سطح را برای رقبا افزایش می دهد. برای کاربران تجاری، حداقل برخی از خطرات قانونی را کاهش می دهد که صدای تولید شده توسط هوش مصنوعی را به یک دارایی بزرگ در تبلیغات و تولید رسانه تبدیل کرده است.
یک بازار شلوغ و دعوا
تولید موسیقی هوش مصنوعی در حال تبدیل شدن به یکی از بحث برانگیزترین گوشه های رسانه های مولد است. شکست دادگاه آلمانی سونو در مورد مسائل مربوط به کپی رایت نشان داد که محیط قانونی برای مدل هایی که در زمینه ضبط های محافظت شده آموزش دیده اند، به ویژه در اروپا سخت تر می شود. در مقابل این پسزمینه، تصمیم Google برای تأکید بر صدور مجوز - در حالی که جزئیات را محرمانه نگه میدارد - به عنوان یک سپر قانونی و یک پیام بازاریابی با هدف مشتریان سازمانی محتاط خوانده میشود.
خطرات رقابتی نیز در مورد توزیع است. پایگاه کاربری Gemini به Lyria 3.5 دسترسی پیدا میکند که استارتآپهای موسیقی مستقل برای مطابقت با آن تلاش میکنند، و ادغام با Google Vids به این معنی است که موسیقی متنهای هوش مصنوعی میتواند تقریباً یک شبه به بخشی استاندارد از ایجاد ویدیو در محل کار تبدیل شود.
چه معنایی برای سازندگان دارد
برای نوازندگان فعال، ورود یک مدل موسیقی صیقلی و دارای داده های مجوز در داخل یک دستیار جریان اصلی یک پیشرفت دو طرفه است. هزینه آهنگهای جینگل، آهنگهای پشتیبان و آهنگهای شخصیشده را تقریباً به صفر میرساند، در حالی که سؤالات آشنا را در مورد نحوه رقابت هنرمندان انسانی با خروجی فوری و کافی ایجاد میکند. در حال حاضر، پیامرسانی گوگل به جای جایگزینی تولید استودیویی، بر خلاقیت در مقیاس جشن و کمک متمرکز است.
آنچه واضح است این است که موسیقی هوش مصنوعی از مرحله نمایشی خارج می شود. با توجه به اینکه Lyria 3.5 در برنامه Gemini، Flow Music، AI Studio، Google Vids و یک API عمومی زندگی میکند، اکنون تولید یک آهنگ قابل استفاده یک ویژگی است، نه یک دسته محصول خاص خود - و صنعت خواهد دید که آیا ادعای آموزش مجاز مورد بررسی قرار میگیرد یا خیر.
از هوش مصنوعی جلوتر بمانید
چشم انداز ابزار هوش مصنوعی هر روز تغییر می کند. [آخرین پیشرفتهای هوش مصنوعی] (https://aibuzzwire.news) را در یک مکان دریافت کنید.
اخبار هوش مصنوعی را بیشتر بخوانید →