A Sony Music e o Universal Music Group entraram com mais um processo contra o gerador de música AI Suno, e desta vez as gravadoras estão fazendo uma acusação incomum: “lavagem de modelos”. A reclamação, compartilhada com The Verge, argumenta que o novo modelo v6 da Suno ainda é construído com base em suas gravações protegidas por direitos autorais – mesmo que a própria v6 nunca tenha sido treinada diretamente nelas.

O argumento da 'lavagem de modelos'

O cerne da disputa é a afirmação da Suno de que a v6 representa uma ruptura clara com seus modelos anteriores. Os rótulos argumentam o contrário: que treinar um novo modelo com base nos resultados de um modelo infrator não elimina a infração, mas a branqueia. Para mais contexto sobre esta história, confira nossa últimos desenvolvimentos em IA.

"Treinar um 'novo' modelo nos resultados de um modelo infrator não elimina a infração; ele a lava, passando o valor da expressão dos Requerentes das gravações copiadas para os modelos contaminados, desses modelos para seus resultados e desses resultados para v6", afirma a denúncia. "V6 não é um novo começo; é o fruto da mesma árvore envenenada."

De acordo com as gravadoras, os modelos anteriores da Suno foram treinados em músicas não licenciadas extraídas do YouTube e de outras fontes, e a v6 herda essa mancha porque foi treinada fortemente nas saídas do usuário – as músicas geradas por aqueles sistemas anteriores, supostamente infratores.

Sony e Universal são redutos notáveis ​​no espaço musical de IA: ao contrário de alguns de seus concorrentes, eles nunca assinaram um acordo de licenciamento com a Suno, deixando a empresa sem autorização para usar seus catálogos.

Uma nova reviravolta: reivindicações de destilação

A reclamação da Sony vai além, alegando que Suno usou destilação para treinar v6 – uma técnica na qual um novo modelo é treinado para replicar os resultados dos modelos de “professores” existentes, em vez de aprender com dados brutos. Se a v6 foi destilada a partir de modelos antecessores baseados em gravações infratoras, argumentam as gravadoras, os novos dados de treinamento não mudam nada sobre a violação subjacente.

“Mesmo um modelo não treinado diretamente nas gravações dos Requerentes é informado e se beneficia das cópias não autorizadas retidas pela Suno”, diz a denúncia. Na opinião das gravadoras, a menos que a Suno realmente comece do zero, seus modelos continuarão a ser construídos com base em dados roubados – não importa quantas vezes a empresa declare um novo começo.

Defesa de Suno

Suno afirmou publicamente que a v6 foi construída de forma diferente. Quando o modelo foi lançado, Jack Brody, da Suno, disse ao The Verge que ele foi “treinado desde o início, com um novo conjunto de dados”, incluindo dados do usuário, embora não tenha oferecido detalhes além disso.

A porta-voz da Suno, Rachel Racusen, confirmou mais tarde que os dados de treinamento incluem “criações” de usuários, dizendo que a v6 foi treinada em “conteúdo licenciado de nossos parceiros, interações incluindo criações e sinais de preferência de nossa comunidade e o aprendizado acumulado de nossa equipe”. Ela não especificou se esses dados incluíam áudio carregado ou resultados derivados de áudio carregado – a distinção que está no cerne da teoria de lavagem das gravadoras.

Pressão crescente sobre o negócio musical de IA

A nova reclamação se soma à já lotada pauta jurídica da Suno. A startup perdeu um caso histórico de direitos autorais alemão para a sociedade de gestão coletiva GEMA em agosto, e a relutância das grandes gravadoras em licenciar seus catálogos deixa a principal estratégia de treinamento da Suno exposta em dois continentes.

O processo anterior das gravadoras nos EUA contra a Suno tinha como objetivo o treinamento de seus modelos de primeira geração em suas gravações. A reclamação da versão 6 efetivamente fecha a rota de fuga mais óbvia: recomeçar com dados sintéticos e criações de usuários. Mesmo que esse caminho esteja legalmente contaminado, as opções da Suno se limitam a acordos de licenciamento nos termos das gravadoras, uma defesa judicial de suas práticas ou a reconstrução de seu corpus de treinamento a partir de músicas que ela possa provar ser licenciada ou original.

Suno não está sozinho ao enfrentar esse aperto. Geradores de música de IA, modelos de imagem e sistemas de texto estão todos enfrentando a mesma questão, à medida que a era inicial de desmantelamento da web aberta dá lugar a um acerto de contas legal. Alguns detentores de direitos optaram pelo licenciamento em vez do litígio, fechando acordos que transformam os seus catálogos em insumos de formação com compensação associada. A Sony e a Universal, ao processarem duas vezes, apostam que os tribunais proporcionarão um resultado melhor do que qualquer licença.

O caso também importa muito além de uma empresa. Cada vez mais se pede aos tribunais que decidam se os resultados da IA ​​— e os modelos treinados nos resultados — podem conter a mancha jurídica dos seus dados de formação. O conceito que os rótulos chamam de lavagem de modelos tem paralelos óbvios na geração de texto e imagem, onde os dados sintéticos extraídos ou gerados a partir de modelos anteriores estão se tornando uma parcela maior dos conjuntos de treinamento.

Se a teoria da Sony e da Universal ganhar força, poderá remodelar a forma como as empresas de IA pensam sobre a proveniência: não apenas o que entrou num modelo, mas o que entrou nos modelos que produziram os seus dados de treino. Por enquanto, a questão segue para um tribunal dos EUA, onde Suno terá que argumentar que a v6 é realmente a ruptura perfeita que afirma ser.

---

Fique à Frente da IA

As últimas notícias, análises e avanços em inteligência artificial — tudo em um só lugar.

Ler mais notícias de IA →