A OpenAI anunciou em 5 de outubro que começará a adicionar marcas d'água invisíveis ao texto gerado pelo ChatGPT e Codex para usuários na União Europeia, sua resposta concreta às regras de proveniência de texto da Lei de IA da UE. Em uma postagem no blog intitulada “Nossa abordagem às regras de proveniência de texto da UE”, a empresa disse que a marca d'água será implementada “nas próximas semanas” para produção elegível no bloco, um plano relatado no mesmo dia por TechCrunch, The Verge, BleepingComputer, Engadget e outros meios de comunicação.

A tecnologia por trás da mudança é chamada textGrain. Em vez de incorporar uma marca visível, o textGrain funciona orientando sutilmente as escolhas de palavras do modelo para que o texto resultante carregue um padrão estatístico que possa ser detectado posteriormente. Os leitores não notarão nada ao consumir ou copiar texto gerado por IA; a detecção requer acesso ao detector da OpenAI, que não está disponível ao público em geral. Para uma visão mais ampla de como reguladores e laboratórios estão colidindo em relação às regras de IA, siga nossa cobertura contínua de políticas de IA.

Como funciona a marca d'água textGrain

A abordagem da OpenAI modifica o processo de seleção de tokens durante a geração. A empresa diz que textGrain “altera ligeiramente as escolhas de palavras do modelo para criar um padrão estatístico que pode ser detectado posteriormente”, de acordo com relatórios da BleepingComputer. A marca d’água fica invisível quando o texto é lido ou copiado, e a OpenAI afirma que ela não prejudica a qualidade da saída.

O lado da detecção é deliberadamente restrito. Juntamente com o lançamento da marca d'água, a OpenAI está abrindo aplicativos para seu detector de marca d'água, mas o acesso será inicialmente limitado a pesquisadores aprovados e organizações especializadas. Esse design mantém a capacidade de detecção fora do alcance de qualquer pessoa que pretenda transformá-la em uma arma, mas também significa que editores, professores e empregadores não podem verificar de forma independente se um trecho de texto tem marca d'água.

O acesso à API é opcional em todo o mundo

O mandato da UE se aplica à produção do ChatGPT e do Codex no bloco, mas a OpenAI está simultaneamente dando uma escolha aos desenvolvedores de todos os lugares. A partir de 5 de outubro, os desenvolvedores de API em todo o mundo podem optar pela marca d'água de texto para modelos suportados. O recurso permanece desabilitado por padrão na API, uma decisão que o The New Stack destacou como um contraste com a abordagem da Anthropic, que ativou a marcação de proveniência para o tráfego da UE no início deste ano em sua própria resposta às mesmas regras.

Essa postura de aceitação tranquilizará os desenvolvedores preocupados com efeitos colaterais imprevistos. A marca d'água estatística altera a forma como os tokens são amostrados, e qualquer modificação na geração acarreta pelo menos um risco teórico de mudança de comportamento em casos extremos. Ao tornar a marca d'água um sinalizador em vez de um padrão, a OpenAI transfere a decisão de conformidade para as empresas que baseiam seus modelos.

Por que a Lei de IA da UE forçou isso

As disposições de transparência da Lei de IA da UE exigem que o texto gerado por IA seja identificável como gerado por máquina, uma obrigação que empurrou tanto a OpenAI quanto a Anthropic em direção a esquemas de marcas d'água estatísticas. A postagem do blog da OpenAI enquadra o textGrain como sua implementação desses requisitos de proveniência, e o PYMNTS relatou o lançamento como o OpenAI atendendo diretamente aos "mandatos da Lei de IA da UE".

O momento é notável. O anúncio da marca d'água ocorre em meio a um período incomumente turbulento para a postura pública da OpenAI: o mesmo ciclo de notícias trouxe a saída do líder de segurança David Robinson, uma investigação da FTC sobre os riscos do consumidor nos principais laboratórios de IA e uma atmosfera de ação judicial de acionistas que manteve a empresa sob escrutínio. A marca d'água é uma das poucas demandas regulatórias que a OpenAI pode satisfazer totalmente com mudanças na infraestrutura, em vez de mudanças no produto, o que pode explicar por que foi lançado primeiro.

O problema: as marcas d’água quebram durante a edição

A própria OpenAI admite a limitação fundamental. A empresa admite que a sua marca d'água pode desaparecer quando o texto é editado, e décadas de pesquisa sobre esteganografia linguística corroboram essa preocupação: parafrasear, traduzir ou mesmo reescrever modestamente pode destruir marcas d'água estatísticas. Qualquer pessoa determinada a lavar texto de IA por meio de uma ferramenta “humanizadora” provavelmente terá sucesso.

Essa fraqueza não impediu que os reguladores exigissem marca d'água e não impediu que os laboratórios a enviassem. O objectivo realista não é a proveniência infalsificável, mas sim aumentar em grande escala o custo do engano casual, a mesma lógica que rege as marcas de água monetárias. Os críticos, incluindo alguns grupos de segurança da IA ​​que têm sido céticos em relação às medidas voluntárias da indústria, argumentam que os detetores acessíveis apenas a organizações aprovadas pouco fazem pelos professores, editores ou plataformas que tentam impor as suas próprias políticas de conteúdo de IA.

O que isso significa para usuários e desenvolvedores

Para usuários do ChatGPT e do Codex dentro da UE, nada mudará visivelmente. O texto terá a mesma aparência e nenhum rótulo aparecerá nas saídas. A marca d'água simplesmente estará lá, detectável em princípio pelos parceiros aprovados da OpenAI.

Para os desenvolvedores, o sinalizador da API chega imediatamente e vale a pena avaliá-lo com cuidado: ativá-lo significa aceitar alterações sutis na amostragem de token em cada conclusão, mesmo para usuários de fora da UE, uma vez que a configuração da API é global. Equipes com latência rigorosa ou orçamentos de qualidade podem querer comparar a geração de marca d'água com sua configuração atual antes de mudar a chave.

A OpenAI afirma que mais detalhes sobre os modelos elegíveis e o processo de aplicação do detector chegarão nas próximas semanas. Como outros laboratórios enfrentam as mesmas obrigações da UE, é improvável que o textGrain seja o último esquema de marca d’água que a indústria implantará este ano.

Fique à frente da IA

A regulamentação está remodelando a forma como os produtos de IA funcionam nos bastidores. Receba os mais recentes desenvolvimentos de IA no AI Buzz Wire, com análises de políticas e notícias de modelos atualizadas ao longo do dia.

Leia mais notícias sobre IA aqui.