सोनी म्यूजिक और यूनिवर्सल म्यूजिक ग्रुप ने एआई म्यूजिक जनरेटर सुनो के खिलाफ एक और मुकदमा दायर किया है, और इस बार लेबल एक असामान्य आरोप लगा रहे हैं: "मॉडल लॉन्ड्रिंग।" द वर्ज के साथ साझा की गई शिकायत में तर्क दिया गया है कि सुनो का नया वी6 मॉडल अभी भी उनकी कॉपीराइट रिकॉर्डिंग पर बनाया गया है - भले ही वी6 को कभी भी उन पर सीधे प्रशिक्षित नहीं किया गया हो।

'मॉडल लॉन्ड्रिंग' तर्क

विवाद का मूल सुनो का दावा है कि v6 अपने पिछले मॉडलों से बिल्कुल अलग है। लेबल इसके विपरीत तर्क देते हैं: कि उल्लंघन करने वाले मॉडल के आउटपुट पर एक नए मॉडल को प्रशिक्षित करने से उल्लंघन समाप्त नहीं होता है, यह इसे लॉन्डर करता है। For more context on this story, see our ongoing latest AI developments.

शिकायत में कहा गया है, "उल्लंघनकारी मॉडल के आउटपुट पर एक 'नए' मॉडल को प्रशिक्षित करने से उल्लंघन खत्म नहीं होता है; यह इसे साफ करता है, कॉपी की गई रिकॉर्डिंग से वादी की अभिव्यक्ति के मूल्य को दागी मॉडल में, उन मॉडल से उनके आउटपुट में और उन आउटपुट से v6 में पास करता है।" "V6 कोई नई शुरुआत नहीं है; यह उसी जहरीले पेड़ का फल है।"

लेबल के अनुसार, सुनो के पहले मॉडलों को यूट्यूब और अन्य स्रोतों से निकाले गए बिना लाइसेंस वाले संगीत पर प्रशिक्षित किया गया था, और वी6 को वह दाग विरासत में मिला है क्योंकि इसे उपयोगकर्ता आउटपुट पर भारी प्रशिक्षण दिया गया था - उन पहले के द्वारा उत्पन्न गाने, कथित रूप से उल्लंघनकारी सिस्टम।

सोनी और यूनिवर्सल एआई संगीत क्षेत्र में उल्लेखनीय होल्डआउट हैं: अपने कुछ प्रतिस्पर्धियों के विपरीत, उन्होंने कभी भी सुनो के साथ लाइसेंसिंग समझौते पर हस्ताक्षर नहीं किए, जिससे कंपनी को अपने कैटलॉग का उपयोग करने के लिए प्राधिकरण के बिना छोड़ दिया गया।

एक नया मोड़: आसवन का दावा

सोनी की शिकायत आगे बढ़ती है, जिसमें आरोप लगाया गया है कि सुनो ने v6 को प्रशिक्षित करने के लिए आसवन का उपयोग किया - एक ऐसी तकनीक जिसमें एक नए मॉडल को कच्चे डेटा से सीखने के बजाय मौजूदा "शिक्षक" मॉडल के आउटपुट को दोहराने के लिए प्रशिक्षित किया जाता है। यदि v6 को उल्लंघनकारी रिकॉर्डिंग पर बनाए गए पूर्ववर्ती मॉडलों से डिस्टिल्ड किया गया था, तो लेबल का तर्क है, नया प्रशिक्षण डेटा अंतर्निहित उल्लंघन के बारे में कुछ भी नहीं बदलता है।

शिकायत में कहा गया है, "यहां तक ​​कि एक मॉडल जो वादी की रिकॉर्डिंग पर सीधे प्रशिक्षित नहीं है, उसे भी सुनो की अनधिकृत प्रतियों के बारे में जानकारी होती है और उससे लाभ होता है।" लेबल के विचार में, जब तक सुनो वास्तव में खरोंच से शुरू नहीं होता है, तब तक इसके मॉडल चोरी किए गए डेटा पर बनाए जाते रहेंगे - चाहे कंपनी कितनी भी बार नई शुरुआत की घोषणा करे।

##सुनो का बचाव

सुनो ने सार्वजनिक रूप से कहा है कि v6 को अलग तरीके से बनाया गया था। जब मॉडल लॉन्च हुआ, तो सुनो के जैक ब्रॉडी ने द वर्ज को बताया कि इसे "डेटा के एक नए सेट के साथ, जमीनी स्तर से प्रशिक्षित किया गया था", जिसमें उपयोगकर्ता डेटा भी शामिल था, हालांकि उन्होंने इसके अलावा कोई विवरण नहीं दिया।

सुनो के प्रवक्ता राचेल राकुसेन ने बाद में पुष्टि की कि प्रशिक्षण डेटा में उपयोगकर्ताओं की "रचनाएँ" शामिल हैं, उन्होंने कहा कि v6 को "हमारे भागीदारों से लाइसेंस प्राप्त सामग्री, हमारे समुदाय से रचनाओं और वरीयता संकेतों सहित इंटरैक्शन, और हमारी टीम से संचित सीख" पर प्रशिक्षित किया गया था। उन्होंने यह निर्दिष्ट नहीं किया कि उस डेटा में अपलोड किया गया ऑडियो, या अपलोड किए गए ऑडियो से प्राप्त आउटपुट शामिल हैं - लेबल के लॉन्ड्रिंग सिद्धांत के मूल में अंतर।

एआई संगीत व्यवसाय पर दबाव बढ़ रहा है

नई शिकायत सुनो के पहले से ही उलझे हुए कानूनी दायरे को और बढ़ा देती है। स्टार्टअप ने अगस्त में कलेक्टिंग सोसाइटी GEMA के हाथों एक ऐतिहासिक जर्मन कॉपीराइट केस खो दिया, और प्रमुख लेबलों द्वारा अपने कैटलॉग को लाइसेंस देने की अनिच्छा के कारण सुनो की मुख्य प्रशिक्षण रणनीति दो महाद्वीपों पर उजागर हो गई।

सुनो के खिलाफ लेबल के पहले अमेरिकी मुकदमे ने उनकी रिकॉर्डिंग पर पहली पीढ़ी के मॉडल के प्रशिक्षण को लक्षित किया था। V6 शिकायत प्रभावी रूप से सबसे स्पष्ट पलायन मार्ग को बंद कर देती है: सिंथेटिक डेटा और उपयोगकर्ता निर्माण के साथ शुरू करना। यदि वह रास्ता भी कानूनी रूप से दागदार है, तो सुनो के विकल्प लेबल की शर्तों पर लाइसेंसिंग सौदों, अपनी प्रथाओं की अदालती रक्षा, या संगीत से अपने प्रशिक्षण कोष का पुनर्निर्माण करने तक ही सीमित हैं, यह साबित कर सकता है कि यह लाइसेंस प्राप्त या मूल है।

सुनो इस दबाव का सामना करने वाला अकेला नहीं है। एआई संगीत जनरेटर, छवि मॉडल और टेक्स्ट सिस्टम सभी एक ही प्रश्न का सामना कर रहे हैं क्योंकि खुले वेब को खत्म करने का प्रारंभिक युग कानूनी गणना का मार्ग प्रशस्त करता है। कुछ अधिकार धारकों ने मुकदमेबाजी के बजाय लाइसेंसिंग को चुना है, ऐसे सौदे किए हैं जो उनके कैटलॉग को मुआवजे के साथ प्रशिक्षण इनपुट में बदल देते हैं। सोनी और यूनिवर्सल, दो बार मुकदमा करके, शर्त लगा रहे हैं कि अदालतें किसी भी लाइसेंस से बेहतर परिणाम देंगी।

मामला एक कंपनी से कहीं आगे का भी मायने रखता है। अदालतों से यह तय करने के लिए कहा जा रहा है कि क्या एआई आउटपुट - और आउटपुट पर प्रशिक्षित मॉडल - उनके प्रशिक्षण डेटा का कानूनी दोष उठा सकते हैं। जिस अवधारणा को लेबल मॉडल लॉन्ड्रिंग कहते हैं, उसमें पाठ और छवि निर्माण में स्पष्ट समानताएं हैं, जहां पहले के मॉडल से स्क्रैप या उत्पन्न सिंथेटिक डेटा प्रशिक्षण सेट का एक बड़ा हिस्सा बन रहा है।

यदि सोनी और यूनिवर्सल का सिद्धांत गति पकड़ता है, तो यह एआई कंपनियों के उद्गम के बारे में सोचने के तरीके को नया आकार दे सकता है: न केवल एक मॉडल में क्या गया, बल्कि उन मॉडलों में क्या गया जो इसके प्रशिक्षण डेटा का उत्पादन करते थे। अभी के लिए, यह प्रश्न अमेरिकी अदालत में चला गया है, जहां सुनो को यह तर्क देना होगा कि वी6 वास्तव में वह क्लीन ब्रेक है जिसका वह दावा करता है।

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →