A Anthropic anunciou na terça-feira uma grande expansão de seus esforços de modelo de acesso com foco na segurança, reestruturando sua iniciativa de acesso controlado em um Programa de Verificação Cibernética (CVP) formal com três níveis distintos para profissionais de segurança cibernética. A mudança ocorre no momento em que a empresa divulga que sua iniciativa Projeto Glasswing descobriu pelo menos 129.000 vulnerabilidades de software verificadas desde abril.
O programa reestruturado permite que equipes de segurança avaliadas executem os modelos mais capazes da Anthropic – incluindo Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1 – com proteções reduzidas e classificadores de bloqueio, permissões que normalmente não estão disponíveis para usuários em geral. De acordo com a Anthropic, o objetivo é colocar capacidades de IA de ponta nas mãos dos defensores antes que atores mal-intencionados usem as mesmas ferramentas como arma. Para mais contexto sobre esta história, confira nossa cobertura da indústria de IA.
Três níveis de acesso, três cenários de ameaças
O novo programa está organizado em três níveis de acesso, cada um adaptado a um tipo diferente de trabalho de segurança:
- Acesso de defesa abrange operações defensivas, como resposta a incidentes, engenharia reversa de malware e análise e validação de vulnerabilidades.
- Red Team Access adiciona testes de penetração autorizados e red-teaming aos casos de uso defensivos, permitindo ataques simulados contra sistemas que as organizações têm permissão para testar.
- Acesso especializado traz o menor número de proteções e é reservado a um conjunto limitado de organizações verificadas que estão autorizadas a testar os próprios sistemas de segurança de IA.
Organizações e equipes de segurança individuais se inscrevem no nível que corresponde ao seu trabalho, e a Anthropic analisa cada inscrição antes de conceder acesso. A empresa disse que todos os três níveis incluem acesso aos seus modelos principais atuais, bem como aos novos modelos lançados no futuro.
Salvaguardas ainda funcionam – seletivamente
A Anthropic combinou o anúncio com dados de avaliação destinados a mostrar que o sistema de níveis separa o trabalho defensivo benigno da capacidade genuinamente perigosa. Em uma avaliação do CyScenarioBench no Claude Opus 5.5, a empresa relatou que as salvaguardas bloquearam 46 das 50 tarefas no nível Defense Access. No nível Red Team Access no mesmo modelo, nenhuma das tarefas foi bloqueada e o modelo completou 34 de 50 – a mesma taxa de conclusão registrada quando nenhuma salvaguarda foi aplicada.
Por outro lado, sem acesso ao CVP, todas as tarefas foram bloqueadas no primeiro prompt, de acordo com a Anthropic.
“Essas avaliações nos dão confiança de que podemos disponibilizar capacidades cibernéticas avançadas com segurança para um conjunto mais amplo de defensores, expandindo os esforços defensivos que iniciamos com o Projeto Glasswing”, disse a empresa em seu anúncio, amplamente divulgado pelo The Hacker News, Reuters e SecurityWeek.
O design reflete uma aposta de que a maior parte do trabalho de segurança defensiva – patches, análise de log, triagem de malware – pode prosseguir sob rígidas proteções, enquanto os testes ofensivos legítimos precisam de um corredor mais amplo. Também reflete como o setor de segurança há muito lida com ferramentas de dupla utilização: examine o profissional, não apenas a ferramenta.
A pegada em expansão da Glasswing
A expansão do programa está intimamente ligada ao Projeto Glasswing, a iniciativa da Anthropic para aplicar seus modelos ao fortalecimento de software crítico. A empresa disse que a Glasswing descobriu pelo menos 129.000 vulnerabilidades de software verificadas entre abril e julho de 2026, e mais 5.500 vulnerabilidades verificadas entre abril e outubro por meio de esforços de verificação de código aberto.
Das vulnerabilidades verificadas, mais de 33.000 foram até agora classificadas como críticas ou de alta gravidade – um número que a Anthropic descreve como provavelmente uma subcontagem significativa, uma vez que se baseia em dados de pesquisas de apenas um subconjunto de parceiros da Glasswing. A empresa estima que o verdadeiro impacto poderá ser pelo menos cinco vezes maior.
Uma visão medida da descoberta de vulnerabilidades orientada por IA
Análises independentes sugerem que a enxurrada de falhas encontradas pela IA não se traduz diretamente numa onda correspondente de violações exploradas. Em uma análise publicada no final do mês passado, o pesquisador do VulnCheck, Patrick Garrity, descobriu que apenas 2 das 300 vulnerabilidades descobertas pela Anthropic ou pelo Projeto Glasswing – cerca de 0,67% – foram exploradas em estado selvagem.
As duas falhas exploradas são CVE-2026-26980, uma vulnerabilidade de injeção de SQL no Ghost CMS, e CVE-2026-61500, uma falha de falsificação de sessão no Rejetto HTTP File Server. Os dados apoiam uma nuance que os investigadores de segurança têm enfatizado: a IA está a reduzir a barreira à descoberta de vulnerabilidades, mas a maioria das falhas que revela nunca estiveram no radar dos atacantes.
O anúncio também surge em meio a um debate mais amplo sobre o trabalho de segurança gerado pela IA. Pesquisas da 1Password e Veracode mostraram que os patches de vulnerabilidade escritos por IA podem introduzir novas falhas, ressaltando que a automação auxilia, mas não substitui a verificação humana.
O que isso significa para a indústria de segurança
Para as equipes de segurança, o CVP reduz a energia de ativação para o uso de modelos de fronteira em trabalhos defensivos reais. Os responsáveis pela resposta a incidentes obtêm um caminho aprovado para assistência na análise de malware; os testadores de penetração obtêm um ambiente governado para ataques assistidos por IA; e o pequeno conjunto de organizações que auditam os próprios sistemas de segurança de IA recebe o acesso menos restrito.
Para a Anthropic, o programa é ao mesmo tempo uma estratégia de segurança e comercial. Concretiza a posição da empresa de que capacidades cibernéticas poderosas devem ser libertadas deliberadamente, para defensores avaliados, em vez de serem totalmente suprimidas – um contraste com os rivais que enfrentaram o escrutínio de modelos com controlos cibernéticos mais fracos. Também aprofunda os relacionamentos da Anthropic com as empresas com maior probabilidade de pagar pelo acesso ao modelo de fronteira: governos, operadores de infraestrutura crítica e grandes fornecedores de segurança.
A empresa não anunciou mudanças de preços vinculadas ao programa, e as inscrições são processadas por meio dos canais de acesso controlados existentes da Anthropic. Dada a escala do que a Glasswing já revelou – e a própria admissão da empresa de que os números provavelmente subestimam a realidade – a indústria de segurança estará observando quantas dessas 129.000 descobertas serão corrigidas antes que os invasores as encontrem primeiro.
---
Fique à Frente da IAAs últimas notícias, análises e avanços em inteligência artificial — tudo em um só lugar.
Ler mais notícias de IA →