索尼音乐和环球音乐集团再次对人工智能音乐生成器 Suno 提起诉讼,这一次,唱片公司提出了一项不同寻常的指控:“模特洗钱”。与 The Verge 分享的投诉称,Suno 的新 v6 模型仍然建立在其受版权保护的录音之上,即使 v6 本身从未直接接受过这些录音的训练。
“模范洗钱”论点
争议的核心是 Suno 声称 v6 代表了与其早期型号的彻底决裂。标签提出了相反的观点:根据侵权模型的输出训练新模型并不能消除侵权行为,而是洗白侵权行为。 更多相关背景,请参阅我们的人工智能资讯。
“在侵权模型的输出上训练‘新’模型并不能消除侵权行为;它会洗白侵权行为,将原告的表达值从复制的录音传递到受污染的模型中,从这些模型传递到其输出中,再从这些输出传递到 v6 中,”诉状称。 “V6不是一个新的开始;它是同一棵毒树的果实。”
根据唱片公司的说法,Suno 的早期模型是根据从 YouTube 和其他来源盗取的未经许可的音乐进行训练的,而 v6 继承了这一污点,因为它在用户输出上进行了大量训练——即由那些早期涉嫌侵权的系统生成的歌曲。
索尼和环球是人工智能音乐领域著名的抵制者:与一些竞争对手不同,他们从未与 Suno 签署许可协议,导致该公司未经授权使用其目录。
新的转折:蒸馏声称
索尼的投诉更进一步,声称 Suno 使用蒸馏来训练 v6——一种训练新模型来复制现有“教师”模型的输出而不是从原始数据中学习的技术。标签认为,如果 v6 是从基于侵权录音构建的前身模型中提取出来的,那么新的训练数据不会改变潜在的违规行为。
诉状中写道:“即使是没有直接接受原告录音训练的模型,也会从 Suno 保留的未经授权的副本中获取信息并从中受益。”在唱片公司看来,除非 Suno 真正从头开始,否则它的模型将继续建立在窃取的数据上——无论该公司多少次宣布重新开始。
苏诺的防守
Suno 公开坚称 v6 的构建方式有所不同。当该模型推出时,Suno 的 Jack Brody 告诉 The Verge,它是“使用一组新数据从头开始训练的”,其中包括用户数据,但他没有提供除此之外的任何细节。
Suno 发言人 Rachel Racusen 后来证实,训练数据包括用户的“创作”,并表示 v6 是根据“我们合作伙伴许可的内容、包括来自我们社区的创作和偏好信号的互动,以及我们团队积累的经验”进行训练的。她没有具体说明这些数据是否包括上传的音频,或者来自上传音频的输出——这是唱片公司洗钱理论的核心区别。
人工智能音乐业务面临的压力越来越大
新的投诉又增加了Suno本已拥挤的法律诉讼案件。 8 月份,这家初创公司在一场具有里程碑意义的德国版权官司中输给了版权收集协会 GEMA,而主要唱片公司不愿为其目录授权,导致 Suno 的核心培训策略暴露在两大洲。
唱片公司早些时候在美国对 Suno 提起诉讼,目标是在其唱片上训练第一代模型。 v6 投诉有效地关闭了最明显的逃生路线:从合成数据和用户创建重新开始。如果这条道路在法律上受到污染,Suno 的选择范围就会缩小到按照唱片公司的条款进行许可交易、在法庭上为其做法辩护,或者从可以证明是许可或原创的音乐中重建其训练语料库。
苏诺并不是唯一面临这种挤压的人。随着早期废除开放网络的时代让位于法律清算,人工智能音乐生成器、图像模型和文本系统都面临着同样的问题。一些权利持有者选择许可而不是诉讼,达成交易,将他们的目录变成附带补偿的培训投入。索尼和环球通过两次起诉,押注法院将提供比任何许可更好的结果。
此案的影响也远远超出了一家公司的范围。法院越来越多地被要求决定人工智能输出以及基于输出训练的模型是否可以携带其训练数据的法律污点。标签称之为模型洗钱的概念在文本和图像生成中具有明显的相似之处,其中从早期模型中抓取或生成的合成数据正在成为训练集的更大份额。
如果索尼和环球的理论获得关注,它可能会重塑人工智能公司对来源的看法:不仅仅是模型中的内容,还有生成训练数据的模型中的内容。目前,问题已转移到美国法院,Suno 必须辩称 v6 确实是其声称的彻底决裂。
---
掌握AI最新动态获取最新的AI新闻、分析和突破——尽在一处。
阅读更多AI新闻 →