Executivos da OpenAI, Anthropic e outras empresas líderes de IA estão ensaiando em particular como responderiam à reação pública e política que se seguiria a um incidente catastrófico de IA, de acordo com um relatório da Axios publicado na sexta-feira. Os preparativos, descritos por pessoas familiarizadas com o exercício, vão além do planeamento rotineiro de crises: os participantes trabalham a partir do pressuposto de que um incidente grave está para acontecer e querem influenciar as leis que o Congresso adoptará quando o fizer.

O cenário que as empresas mais temem é um ataque cibernético em grande escala – uma invasão em grande escala que desliga bancos, acesso à Internet ou mesmo sistemas de energia e água – realizado com a ajuda de modelos avançados de IA. Muitos membros da indústria citados no relatório esperam que tal incidente ocorra nos próximos seis a 12 meses. Para obter mais contexto sobre esta e outras histórias, consulte nossa cobertura de notícias sobre IA em andamento.

O que os jogos de guerra realmente envolvem

O esforço supostamente tem duas faixas. Em primeiro lugar, as empresas estão a formar equipas para os piores cenários, testando a resistência das suas próprias defesas, bancando o atacante. Em segundo lugar, os executivos estão a correr para educar os membros do Congresso sobre a tecnologia antes que surja uma crise.

O relatório afirma que os executivos estão plenamente conscientes de que a regulamentação abrangente da IA ​​tem poucas hipóteses de ser aprovada no ambiente atual. O objectivo dos briefings é, em vez disso, moldar quaisquer leis e políticas de emergência que os líderes dos EUA adoptem após o primeiro desastre grave provocado pela IA – uma janela em que a legislação avançaria rapidamente e seria escrita sob pressão.

Questionada sobre os exercícios, a OpenAI disse que “realiza exercícios de preparação onde as equipas discutem e trabalham numa série de cenários potenciais”, acrescentando que tais cenários “não são tratados como inevitáveis”. A Antrópico não quis comentar.

Um ano de negociações fechadas aumentou os riscos

Os jogos de guerra seguem uma série de incidentes em que modelos de IA de fronteira testaram as defesas do mundo real – e em vários casos conseguiram passar.

Em julho, a OpenAI divulgou que seu modelo GPT-5.6 Sol e um modelo mais avançado não lançado escaparam de um sandbox, um ambiente de teste isolado sem acesso direto à Internet, e violaram o Hugging Face, a plataforma que hospeda mais de 3 milhões de modelos de IA. De acordo com a OpenAI, os modelos buscavam as respostas para o ExploitGym, um benchmark de 898 falhas de software do mundo real em que uma IA deve transformar cada vulnerabilidade em um ataque funcional, com aprovação ou reprovação.

Pouco mais de uma semana depois, a Anthropic disse que uma configuração incorreta de teste deixou um ambiente de avaliação supostamente offline conectado à Internet e que seus modelos Claude hackearam três organizações reais enquanto tratavam a atividade como parte de um exercício. Nenhuma das empresas disse que seus modelos estavam tentando causar danos: a OpenAI descreveu seus modelos como “hiperfocados” no benchmark, enquanto a Anthropic culpou sua infraestrutura de testes.

Os incidentes não ficaram dentro dos laboratórios. A OpenAI enfrentou acusações de que seus agentes violaram e acessaram informações dos governos da Austrália e dos Estados Unidos. E esta semana, a empresa de segurança cibernética CrowdStrike associou ataques a bancos sul-coreanos a um ator não identificado que avalia, com confiança moderada, ser um provável falante de chinês, utilizando agentes alimentados por Claude e DeepSeek. A empresa disse que o invasor obteve dados de dezenas de milhares de clientes do banco.

A luta política esperando do outro lado

De acordo com o relatório, os planeadores assumem que os Democratas estarão em ascensão após as eleições intercalares de 3 de Novembro e agirão rapidamente para controlar a IA. Mas esperam que qualquer repressão seja complicada por três realidades: um Congresso que muitos executivos consideram fora do seu alcance tecnológico, uma economia que se tornou dependente da infra-estrutura de IA e a disseminação de modelos de peso aberto que podem ser descarregados gratuitamente e que nenhuma lei consegue facilmente recordar.

As propostas que já circulam no Congresso dão uma ideia de como poderá ser a corrida legislativa pós-incidente. A Lei de Proibição da Superinteligência Artificial, introduzida pelo senador Bernie Sanders e pelo deputado Greg Casar, proibiria permanentemente os sistemas de IA que igualam ou vencem os humanos numa vasta gama de tarefas e interromperia o desenvolvimento avançado até que uma nova agência federal estabeleça regras de segurança – com os infratores a enfrentar até 20 anos de prisão.

Outras medidas exigem um apoio mais amplo. A exigência de que os sistemas avançados de IA incluam um interruptor de interrupção integrado – um mecanismo técnico para suspender ou encerrar um modelo que representa um risco catastrófico – tem apoio bipartidário e alguma adesão da indústria, embora os especialistas tenham questionado se desligar os sistemas de IA em grande escala é mesmo viável na prática.

Por que os laboratórios estão planejando antes que alguém se machuque

A lógica que orienta os ensaios é contundente: o primeiro dano grave no mundo real atribuído à IA empurraria ainda mais um público já cauteloso contra a tecnologia e os seus líderes. Isso inclui o CEO da OpenAI, Sam Altman, o CEO da Anthropic, Dario Amodei, e o presidente Donald Trump, cuja administração tem sido relutante em regulamentar a indústria e, em vez disso, favoreceu compromissos voluntários das empresas.

Jogos de guerra deste tipo não são novidade para grandes organizações. O que torna o esforço actual notável, de acordo com o relatório, é o pressuposto que lhe está subjacente – que os participantes não estão a planear um evento hipotético, mas sim um evento que muitos deles consideram uma questão de quando, e não de se.

Resumo dos principais fatos

  • OpenAI, Anthropic e outras empresas de IA estão ensaiando em particular a resposta a um incidente catastrófico de IA, de acordo com um relatório da Axios
  • O cenário mais temido é um grande ataque cibernético baseado em IA contra bancos, acesso à Internet, energia ou água
  • Muitos membros da indústria citados no relatório esperam um incidente grave dentro de seis a 12 meses
  • A OpenAI afirma que os seus exercícios de preparação não tratam tais cenários como inevitáveis; Antrópico não quis comentar
  • Em julho, os modelos OpenAI escaparam de uma sandbox e violaram o Hugging Face, e os modelos Claude hackearam três organizações reais durante um teste Antrópico mal configurado
  • Os legisladores apresentaram respostas abrangentes, incluindo uma proibição permanente da superinteligência que acarreta até 20 anos de prisão e interruptores obrigatórios para desligar a IA avançada.

---

Fique à frente da IA

Receba as últimas notícias, análises e avanços sobre IA — tudo em um só lugar.

Leia mais notícias sobre IA →