سونی موزیک و گروه موسیقی یونیورسال شکایت دیگری را علیه سازنده موسیقی هوش مصنوعی سونو تنظیم کردهاند و این بار لیبلها اتهامی غیرعادی را مطرح میکنند: «شستشوی مدل». این شکایت که با The Verge به اشتراک گذاشته شد، استدلال میکند که مدل جدید v6 سونو همچنان بر روی ضبطهای دارای حق چاپ آنها ساخته شده است - حتی اگر خود v6 هرگز مستقیماً روی آنها آموزش داده نشده باشد.
استدلال "مدل شویی".
هسته اصلی این مناقشه ادعای سونو است مبنی بر اینکه v6 نشاندهنده فاصلهای کامل از مدلهای قبلی آن است. برچسبها خلاف این را استدلال میکنند: اینکه آموزش یک مدل جدید بر روی خروجیهای یک مدل متخلف، نقض را از بین نمیبرد، بلکه آن را میشوید. For more context on this story, see our ongoing breaking AI news.
در شکایت آمده است: «آموزش یک مدل «جدید» بر روی خروجیهای یک مدل متخلف، نقض را از بین نمیبرد، بلکه آن را پاکسازی میکند و ارزش بیان شاکیان را از ضبطهای کپیشده به مدلهای آلوده، از آن مدلها به خروجیهای آنها و از آن خروجیها به نسخه ۶ منتقل میکند. "V6 یک شروع تازه نیست، بلکه میوه همان درخت مسموم است."
با توجه به برچسبها، مدلهای قبلی Suno بر روی موسیقیهای بدون مجوز که از یوتیوب و منابع دیگر حذف شدهاند، آموزش دیدهاند، و نسخه ۶ این لکهها را به ارث میبرد زیرا به شدت بر روی خروجیهای کاربر آموزش داده شده است – آهنگهایی که قبلاً توسط سیستمهای ادعایی نقضکننده قوانین تولید شدهاند.
سونی و یونیورسال در فضای موسیقی هوش مصنوعی دارای جایگاه قابل توجهی هستند: برخلاف برخی از رقبای خود، آنها هرگز قرارداد مجوزی با سونو امضا نکردند و شرکت را بدون مجوز برای استفاده از کاتالوگهایشان رها کردند.
پیچ و تاب جدید: ادعای تقطیر
شکایت سونی فراتر می رود و ادعا می کند که Suno از تقطیر برای آموزش نسخه 6 استفاده کرده است - تکنیکی که در آن یک مدل جدید برای تکرار خروجی های مدل های "معلم" موجود به جای یادگیری از داده های خام آموزش داده می شود. برچسبها استدلال میکنند که اگر نسخه ۶ از مدلهای قبلی ساخته شده بر روی ضبطهای نقضکننده تقطیر شده باشد، دادههای آموزشی جدید چیزی را در مورد نقض اساسی تغییر نمیدهد.
در شکایت آمده است: «حتی مدلی که مستقیماً در مورد ضبطهای شاکیان آموزش ندیده است، از کپیهای غیرمجاز نگهداری شده سونو مطلع میشود و از آن سود میبرد». از نظر لیبلها، مگر اینکه سونو واقعاً از صفر شروع کند، مدلهای آن همچنان بر اساس دادههای سرقت شده ساخته میشوند – مهم نیست که چند بار شرکت شروع جدیدی را اعلام کند.
دفاع سونو
سونو علناً اعلام کرده است که نسخه ۶ متفاوت ساخته شده است. هنگامی که این مدل عرضه شد، جک برودی از سونو به The Verge گفت که این مدل از ابتدا با مجموعهای از دادههای جدید آموزش دیده است، که شامل دادههای کاربر نیز میشود، اگرچه او جزییاتی فراتر از آن ارائه نکرد.
سخنگوی سونو، ریچل راکوسن، بعداً تأیید کرد که دادههای آموزشی شامل «محصولات» کاربران است، و گفت نسخه ۶ بر روی «محتوای دارای مجوز از شرکای ما، تعاملات شامل خلاقیتها و سیگنالهای ترجیحی از جامعه ما، و آموختههای انباشتهشده از تیم ما» آموزش داده شده است. او مشخص نکرد که آیا این دادهها شامل صدای بارگذاریشده است یا خروجیهایی که از صدای بارگذاریشده به دست میآیند - وجه تمایز در قلب تئوری شستشوی برچسبها.
افزایش فشار بر تجارت موسیقی هوش مصنوعی
شکایت جدید به پرونده حقوقی شلوغ Suno اضافه می کند. این استارتآپ در ماه آگوست، یک پرونده برجسته حق چاپ آلمان را به جامعه جمعآوری GEMA از دست داد، و عدم تمایل لیبلهای اصلی به مجوز کاتالوگهای خود، استراتژی اصلی آموزشی Suno را در دو قاره آشکار میکند.
شکایت قبلی این لیبلها در ایالات متحده علیه سونو، آموزش مدلهای نسل اول آنها را در ضبطهایشان هدف قرار داد. شکایت v6 به طور موثر واضح ترین راه فرار را می بندد: شروع دوباره با داده های مصنوعی و خلاقیت های کاربر. اگر حتی این مسیر از نظر قانونی لکه دار باشد، گزینه های سونو محدود به صدور مجوز معاملات بر اساس شرایط لیبل، دفاع در دادگاه از شیوه های خود، یا بازسازی مجموعه آموزشی خود از موسیقی است که می تواند ثابت کند دارای مجوز یا اصلی است.
سونو در مواجهه با این فشار تنها نیست. مولدهای موسیقی هوش مصنوعی، مدلهای تصویر و سیستمهای متنی، همگی با همان سوالی مواجه هستند که دوران اولیه حذف وب باز جای خود را به یک حساب قانونی میدهد. برخی از دارندگان حقوق، صدور مجوز را به جای دعوی قضایی انتخاب کرده اند، معاملات قابل توجهی که کاتالوگ آنها را به ورودی های آموزشی با غرامت پیوست تبدیل می کند. سونی و یونیورسال، با دو بار شکایت، شرط میبندند که دادگاه نتیجه بهتری از هر مجوزی ارائه خواهد کرد.
این پرونده همچنین بسیار فراتر از یک شرکت اهمیت دارد. به طور فزایندهای از دادگاهها خواسته میشود تا تصمیم بگیرند که آیا خروجیهای هوش مصنوعی - و مدلهای آموزشدیده بر روی خروجیها - میتوانند لکههای قانونی دادههای آموزشی خود را داشته باشند یا خیر. مفهومی که برچسبها آن را شستشوی مدل مینامند، شباهتهای آشکاری در تولید متن و تصویر دارد، جایی که دادههای مصنوعی خراشیده شده یا تولید شده از مدلهای قبلی در حال تبدیل شدن به سهم بیشتری از مجموعههای آموزشی است.
اگر تئوری سونی و یونیورسال مورد توجه قرار گیرد، میتواند نحوه تفکر شرکتهای هوش مصنوعی در مورد منشأ را تغییر دهد: نه فقط آنچه در یک مدل وجود دارد، بلکه مدلهایی که دادههای آموزشی آن را تولید میکنند. در حال حاضر، این سوال به یک دادگاه ایالات متحده منتقل می شود، جایی که Suno باید استدلال کند که v6 واقعاً همان چیزی است که ادعا می کند.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →