A OpenAI está conversando com vários avaliadores independentes para ajudar a aumentar o número de empresas que têm experiência em segurança de IA de ponta e podem fornecer avaliações eficazes de terceiros, disse a empresa em uma postagem de blog publicada na terça-feira, 22 de setembro, conforme relatado pela PYMNTS.

A postagem apresenta as prioridades e princípios propostos pela OpenAI para uma supervisão eficaz de terceiros – uma estrutura que, segundo ela, deveria ser aplicada a todos os laboratórios de IA de ponta à medida que treinam, avaliam e implantam modelos cada vez mais capazes. O anúncio chega a meio de um mês invulgarmente carregado para a política de segurança da IA, e parece tanto uma concessão aos críticos como uma tentativa de moldar as regras antes que os governos as escrevam. Para quem acompanha as notícias de última hora sobre IA, é o mais recente movimento em uma disputa de semanas entre os laboratórios, seus críticos e reguladores sobre quem verifica se os modelos de fronteira são seguros.

O que a OpenAI está propondo

“Estamos empenhados em apoiar avaliadores independentes e em estabelecer padrões internacionais mais claros e partilhados – tanto através de leis futuras como de iniciativas de governação privada – para avaliações eficazes de terceiros”, disse OpenAI no post, de acordo com PYMNTS.

O problema central que a OpenAI descreve é ​​uma falha de mercado: existem simplesmente muito poucas organizações com profundidade técnica para auditar um modelo de fronteira. Uma avaliação de segurança significativa requer acesso a sistemas não divulgados, conhecimentos especializados em áreas que vão da cibersegurança à biossegurança e independência institucional para publicar conclusões indesejáveis. Ao recrutar e apoiar vários avaliadores em vez de um único auditor privilegiado, a OpenAI afirma que pretende construir um ecossistema onde a avaliação de terceiros seja uma parte rotineira da implantação de sistemas de fronteira – e não um exercício único de relações públicas.

A empresa não nomeou os avaliadores com quem está a falar, e resta saber se os acordos resultantes darão aos avaliadores o acesso, a independência de financiamento e os direitos de publicação que os investigadores em segurança consideram significativos.

Uma semana de chicotadas na política de IA

A proposta chega em meio a uma rápida sequência de desenvolvimentos políticos que definiram o debate sobre IA de setembro:

  • Segunda-feira, 21 de setembro: A OpenAI apelou aos Estados Unidos para liderarem um esforço internacional para desenvolver padrões técnicos globais para IA de fronteira - incluindo o autoaperfeiçoamento recursivo, o ponto em que os sistemas de IA se melhoram. A empresa alertou que o desenvolvimento totalmente autônomo da IA ​​poderia ultrapassar a capacidade humana de compreendê-la e controlá-la, e disse que as decisões sobre se e como proceder precisam ser tomadas agora.
  • Sexta-feira, 18 de setembro: O governador da Califórnia, Gavin Newsom, assinou uma ordem executiva convocando especialistas nacionais para reforçar as leis de segurança de IA do estado, explicitamente destinadas a acelerar a implementação de nova supervisão de terceiros sobre riscos de segurança e proteção em sistemas de IA.
  • Sábado, 19 de setembro: O presidente Donald Trump rejeitou as preocupações de segurança da indústria em uma postagem do Truth Social, escrevendo: "Não impediremos ou sufocaremos de forma alguma o crescimento desta indústria incrível. A IA é a próxima Revolução Industrial, ou Internet, mas será ainda maior e mais impactante, possivelmente até 25% do PIB do nosso país."

Tal como noticiámos no início desta semana, a proposta de normas da OpenAI liderada pelos EUA marcou uma mudança marcante para uma empresa que passou anos a resistir à supervisão vinculativa – e os novos princípios de avaliação de terceiros estendem essa postura à frente da governação privada.

O problema da independência

A adoção de vigilantes externos pela OpenAI segue uma proposta paralela de seu principal rival. Cerca de uma semana antes, o CEO da Anthropic, Dario Amodei, publicou um ensaio propondo um plano de segurança de IA construído em torno de avaliadores independentes integrados em empresas líderes de IA, coordenação entre empresas em países democráticos e, eventualmente, um acordo internacional que inclua a China.

Ambas as propostas suscitaram cepticismo imediato por parte dos especialistas. A CNBC informou que uma coalizão de mais de 100 especialistas em IA está pedindo independência e transparência da Anthropic, OpenAI e outros laboratórios modelo de fundação que conduzem avaliações, alertando que os avaliadores que estão incorporados - ou pagos por - as empresas que auditam enfrentam conflitos de interesse inevitáveis. Cães de guarda apoiados pelo pioneiro da IA, Geoffrey Hinton, pressionaram ambas as empresas sobre os detalhes dos seus planos de segurança, e os comentadores assinalaram a porta giratória entre as organizações de avaliação de segurança da IA ​​e os próprios laboratórios: as pessoas que avaliam os trabalhos de segurança também podem ser aqueles que os escreveram.

Essa tensão é o cerne do debate que a nova postagem da OpenAI tenta acalmar. A resposta da empresa – mais avaliadores, padrões internacionais partilhados e supervisão aplicada tanto através de leis futuras como de iniciativas privadas – é um enquadramento, não ainda uma garantia. Os críticos apontarão que os laboratórios que propõem as regras são os mesmos laboratórios sujeitos a elas, e que a governação auto-formada tem historicamente favorecido as empresas que as moldam.

Por que é importante

Os próximos modelos de fronteira já estão em treinamento e a janela para projetar a supervisão antes da implantação está se fechando. Se o recrutamento de avaliadores independentes pela OpenAI produzir auditores com acesso real e independência real, poderá tornar-se o modelo para a forma como a IA de fronteira é governada em todo o mundo - um regime privado que os legisladores em Washington, Bruxelas e outros lugares não conseguiram construir até agora. Se produzir consultorias afiliadas a NDAs, confirmará a pior leitura dos céticos.

De qualquer forma, o facto de a OpenAI estar a competir com a Anthropic sobre quem pode propor o regime de supervisão mais credível é em si novo. Há um ano, os laboratórios estavam unificados principalmente na oposição à regulamentação. Agora eles estão correndo para defini-lo.

---

Fique à frente da IA

Receba as últimas notícias, análises e avanços sobre IA — tudo em um só lugar.

Leia mais notícias sobre IA →