أصدرت Google Lyria 3.5، أحدث إصدار من نموذج توليد الموسيقى المدعم بالذكاء الاصطناعي، مباشرة داخل تطبيق Gemini ومن خلال واجهة برمجة تطبيقات المطور، حسبما أعلنت الشركة في نهاية هذا الأسبوع. يضع الإصدار التجريبي إنشاء تحويل النص إلى موسيقى أمام قاعدة مستخدمي Gemini الهائلة ويمنح المطورين وصولاً برمجيًا إلى النموذج لأول مرة في هذا الجيل.

تم الإبلاغ عن الإطلاق بواسطة The Decoder ومنافذ أخرى، والتي أشارت إلى أن Google تضع Lyria 3.5 كنموذج موسيقي أكثر قدرة حتى الآن، مع غناء أفضل وترتيبات أكمل من سابقتها. إنها أيضًا أحدث علامة على أن سباق أدوات الذكاء الاصطناعي يسير الآن مباشرة عبر الوسائط الإبداعية - وهو أمر نتابعه عن كثب في [تغطية أدوات الذكاء الاصطناعي] (https://aibuzzwire.news).

ما يمكن أن يفعله Lyria 3.5

وفقًا لـ Google، يقدم Lyria 3.5 أصواتًا أكثر تعبيرًا وترتيبات موسيقية أكثر ثراءً من الإصدار الذي يحل محله. يمكن للمستخدمين اختيار النوع والأسلوب في تطبيق Gemini، والاختيار بين الغناء والآلات الموسيقية، وإنشاء مسارات تتراوح من المقاطع القصيرة إلى المقطوعات الموسيقية الأطول.

أضافت جوجل أيضًا قوالب مصممة لمساعدة القادمين الجدد على البدء، بما في ذلك الإعدادات المسبقة لموسيقى الخلفية وأغاني أعياد الميلاد المخصصة - وهي علامة على أن الشركة تستهدف المستخدمين العاديين والاحتفالات بقدر ما تستهدف الموسيقيين. إن العرض التقديمي مألوف من خلال ميزات Gemini الأخرى من Google: خفض الحاجز حتى يتمكن أي شخص من إنتاج قطعة أثرية نهائية من جملة أو اثنتين من الوصف.

ويعكس سير العمل هذه البساطة. يصف المستخدم نوع المسار الذي يريده، ويحدد معلمات النوع والأسلوب، ويقرر ما إذا كان يجب أن يحمل الإخراج غناءً أو يظل فعالاً. نظرًا لأن النموذج يتعامل مع كل من المقاطع القصيرة والمقطوعات الأطول، فإن الأداة نفسها تغطي رسالة عيد ميلاد، أو سرير بودكاست، أو مقطع صوتي لفيديو منزلي - وهي حالات استخدام كانت تتطلب في السابق إما اشتراكًا في موسيقى المخزون أو ملحنًا مستأجرًا.

حيث يتوفر النموذج

يتجاوز الطرح تطبيق Gemini. وفقًا لإعلان جوجل، يتوفر Lyria 3.5 أيضًا في Google Flow Music مع ميزات إضافية، وفي Google AI Studio للمطورين، وفي Google Vids، أداة إنشاء الفيديو التي تعمل بالذكاء الاصطناعي للشركة. ويعني الوصول إلى واجهة برمجة التطبيقات (API) أن تطبيقات الطرف الثالث يمكن أن تعتمد على النموذج مباشرةً، مما قد يؤدي إلى ظهور موجة من الميزات التي تدعم الموسيقى في تطبيقات الطرف الثالث في الأشهر المقبلة.

هذا الاتساع مهم. إن تضمين نموذج موسيقى عبر مساعد المستهلك ومنصة المطورين ومحرر الفيديو يمنح Google أسطحًا متعددة حيث يصبح الصوت الذي يتم إنشاؤه خيارًا إبداعيًا افتراضيًا بدلاً من حداثة مستقلة.

بالنسبة للمطورين، يعد الوصول إلى AI Studio هو القطعة البارزة. إنه ينقل Lyria من فضول المستهلك إلى لبنة أساسية: يمكن لتطبيقات اللياقة البدنية إنشاء موسيقى تمرين تكيفية، ويمكن لاستوديوهات الألعاب تسجيل المستويات من الناحية الإجرائية، ويمكن لأدوات التعليم إنتاج أغانٍ مخصصة للدروس. لم تعلن جوجل عن تسعير واجهة برمجة التطبيقات (API) في المواد التي تم الإبلاغ عنها حتى الآن، لذلك يبقى أن نرى كيفية قياس النموذج - لكن التوفر وحده يشير إلى أن الشركة تريد تضمين Lyria 3.5 في اقتصاد التطبيقات الأوسع، وليس مقتصرًا على منتجاتها الخاصة.

الملعب التدريبي المرخص

الجزء الأكثر وضوحًا في إعلان Google يتعلق ببيانات التدريب. تقول جوجل إن نموذج Lyria تم تدريبه فقط على المحتوى المرخص - وهو تناقض واضح مع Suno، شركة الموسيقى الناشئة ذات الذكاء الاصطناعي التي أدت ممارساتها التدريبية إلى رفع دعاوى قضائية بشأن حقوق الطبع والنشر، بما في ذلك دعوى قضائية ألمانية بارزة رفعتها مجموعة حقوق الموسيقى GEMA والتي خسرتها Suno في وقت سابق من هذا العام.

ولم تشارك جوجل تفاصيل حول بيانات التدريب التي استخدمتها بالفعل، كما أشار موقع The Decoder. لكن تأطير المحتوى المرخص يرسم خطًا واضحًا في صناعة أصبح فيها مصدر بيانات التدريب بمثابة تمييز قانوني وتجاري. بالنسبة لأصحاب الحقوق، فإن المختبر الرئيسي الذي يطالب بالحصول على تدريب مرخص بالكامل يرفع من مستوى المنافسين؛ بالنسبة لمستخدمي الأعمال، فهو يقلل على الأقل من بعض المخاطر القانونية التي جعلت الصوت الناتج عن الذكاء الاصطناعي أحد الأصول المشحونة في مجال الإعلان والإنتاج الإعلامي.

سوق مزدحم ومثير للجدل

أصبح توليد موسيقى الذكاء الاصطناعي أحد أكثر الجوانب المثيرة للجدل في الوسائط التوليدية. تشير هزيمة سونو أمام المحكمة الألمانية بشأن مسائل حقوق الطبع والنشر إلى أن البيئة القانونية للعارضات المدربات على التسجيلات المحمية أصبحت أكثر صرامة، خاصة في أوروبا. على هذه الخلفية، فإن قرار جوجل بالتركيز على الترخيص - مع الحفاظ على سرية التفاصيل - يعتبر بمثابة درع قانوني ورسالة تسويقية تستهدف عملاء المؤسسات الحذرين.

تتعلق المخاطر التنافسية أيضًا بالتوزيع. تمنح قاعدة مستخدمي Gemini Lyria 3.5 إمكانية الوصول التي تكافح الشركات الناشئة المستقلة للموسيقى من أجل مطابقتها، ويعني التكامل في Google Vids أن الموسيقى التصويرية للذكاء الاصطناعي يمكن أن تصبح جزءًا قياسيًا من إنشاء الفيديو في مكان العمل بين عشية وضحاها تقريبًا.

ماذا يعني ذلك بالنسبة لمنشئي المحتوى

بالنسبة للموسيقيين العاملين، فإن وصول نموذج موسيقي مصقول ومرخص للبيانات داخل مساعد رئيسي يعد تطورًا ذا حدين. فهو يقلل من تكلفة الأناشيد والمسارات المساندة والأغاني المخصصة إلى ما يقرب من الصفر، بينما يثير أسئلة مألوفة حول كيفية تنافس الفنانين البشريين مع الإنتاج الفوري والكافي. في الوقت الحالي، تركز رسائل Google على المساعدة والإبداع على نطاق الاحتفال بدلاً من استبدال إنتاج الاستوديو.

ما هو واضح هو أن موسيقى الذكاء الاصطناعي تخرج من المرحلة التجريبية. مع وجود Lyria 3.5 داخل تطبيق Gemini، وFlow Music، وAI Studio، وGoogle Vids، وواجهة برمجة التطبيقات العامة، أصبح إنشاء أغنية قابلة للاستخدام الآن ميزة، وليس فئة منتج خاصة بها - وستراقب الصناعة ما إذا كانت مطالبة التدريب المرخص قابلة للتدقيق.

ابق في صدارة الذكاء الاصطناعي

يتغير مشهد أدوات الذكاء الاصطناعي يوميًا. احصل على أحدث تطورات الذكاء الاصطناعي في مكان واحد.

اقرأ المزيد من أخبار الذكاء الاصطناعي →