A OpenAI aumentou a recompensa pela descoberta de “jailbreaks universais” em seus modelos de IA para US$ 50.000, mais do que dobrando a recompensa anterior e sinalizando que a empresa vê certas classes de desvios de segurança como graves o suficiente para justificar um pagamento premium.

O programa Bio Bug Bounty atualizado, anunciado pela OpenAI em 9 de julho de 2026, pede aos pesquisadores de segurança que encontrem prompts que possam romper universalmente as grades de segurança do modelo – desvios que funcionam em múltiplas conversas e contextos, em vez de casos extremos isolados. O programa visa especificamente jailbreaks relacionados a ameaças biológicas, onde um modelo de IA poderia ser coagido a fornecer orientação prática sobre a criação de patógenos ou armas perigosas.

Para obter mais notícias sobre IA e análises aprofundadas, visite AI Buzz Wire.

Por que US$ 50.000?

O aumento da recompensa reflete a preocupação crescente sobre a lacuna entre o que os modelos de IA de fronteira são orientados a não fazer e o que determinados usuários podem realmente extrair deles. Um jailbreak universal é particularmente perigoso porque, ao contrário de um truque único de injeção imediata, representa uma fraqueza sistemática que pode ser replicada e compartilhada.

A TechRepublic informou em 10 de julho que o aumento da recompensa ocorre em meio a um exame mais minucioso dos modelos mais poderosos da OpenAI. A administração Trump pediu anteriormente à OpenAI que limitasse o lançamento do seu mais novo modelo com capacidade cibernética a um grupo escolhido a dedo de utilizadores avaliados, de acordo com o National Technology News, reflectindo a preocupação do governo sobre o potencial ofensivo dos sistemas de IA de fronteira.

Agência do Reino Unido descobre que as capacidades cibernéticas da IA estão acelerando

O anúncio da recompensa coincide com um alerta severo do AI Security Institute (AISI) do Reino Unido, que avalia de forma independente as capacidades cibernéticas dos modelos de fronteira desde 2024.

Em uma avaliação de abril de 2026 do GPT-5.5 da OpenAI, o AISI descobriu que o modelo alcançou uma taxa de aprovação de 71,4% em tarefas de segurança cibernética de nível Expert – a mais alta de qualquer modelo testado, superando Claude Mythos Preview da Anthropic em 68,6%, GPT-5.4 em 52,4% e Opus 4.7 em 48,6%.

Um ponto de referência foi particularmente impressionante. A AISI projetou um desafio personalizado de engenharia reversa de máquina virtual – uma tarefa de várias etapas que exige que um invasor crie um decodificador de instruções personalizado, faça engenharia reversa de um autenticador e recupere uma senha válida. O testador humano especialista da Crystal Peak Security resolveu o desafio em aproximadamente 12 horas usando ferramentas profissionais. O GPT-5.5 resolveu o problema em 10 minutos e 22 segundos, a um custo de US$ 1,73 em uso de API, sem assistência humana.

Dobrando a cada poucos meses

Numa análise separada publicada em maio de 2026, o AISI descobriu que a duração das tarefas cibernéticas que os modelos de IA de fronteira podem completar autonomamente tem duplicado a cada 4,7 meses desde o final de 2024 – uma aceleração em relação à sua estimativa de novembro de 2025 de 8 meses.

“A atual taxa de mudança indica um potencial crescente para que as capacidades cibernéticas da IA ​​se traduzam em riscos tangíveis – riscos que as organizações do Reino Unido terão de enfrentar nos próximos meses”, escreveu o AISI.

Claude Mythos Preview e GPT-5.5 excederam substancialmente a tendência de duplicação anterior, levantando a questão de saber se o ritmo está ficando ainda mais rápido.

Jailbreaks universais: as apostas mais altas

A distinção entre um jailbreak restrito e um universal é crítica. Um jailbreak estreito pode induzir um modelo a produzir uma única resposta não permitida sob condições específicas. Um jailbreak universal, por outro lado, representa uma brecha fundamental na arquitetura de segurança do modelo – um método que contorna de forma confiável as barreiras de proteção em uma ampla gama de entradas.

A decisão da OpenAI de oferecer US$ 50.000 por tais descobertas sugere que a empresa acredita que os jailbreaks universais são raros o suficiente para justificar uma grande recompensa e perigosos o suficiente para justificar o investimento. Se um jailbreak universal para consultas relacionadas a ameaças biológicas fosse descoberto por um agente mal-intencionado antes de ser corrigido, as consequências poderiam ser graves.

O programa também desempenha uma função de transparência. Ao convidar investigadores externos para investigar os seus modelos, a OpenAI pode identificar e corrigir vulnerabilidades antes que sejam exploradas em estado selvagem – desde que a recompensa seja grande o suficiente para atrair o calibre de talento necessário.

Uma corrida entre ataque e defesa

Os desenvolvimentos paralelos – o aumento das recompensas da OpenAI e as avaliações de capacidade do AISI – ilustram a tensão central na segurança da IA ​​hoje. Os modelos estão se tornando dramaticamente mais capazes em tarefas cibernéticas, com o horizonte temporal das tarefas que podem ser concluídas dobrando a cada poucos meses. Ao mesmo tempo, as empresas correm para corrigir as vulnerabilidades que tornam os seus modelos perigosos.

Se as recompensas e as equipes vermelhas conseguirão acompanhar a aceleração da curva de capacidade permanece uma questão em aberto. Mas o valor de US$ 50.000 envia um sinal claro: a OpenAI acredita que a ameaça é séria o suficiente para pagar o máximo a qualquer um que possa provar que as rachaduras existem.

Fique à frente da IA

À medida que os modelos de fronteira se tornam mais poderosos, a batalha entre as barreiras de segurança e aqueles que tentam quebrá-las só se intensificará. Acompanhe os últimos desenvolvimentos em AI Buzz Wire.

Leia mais cobertura da indústria de IA em AI Buzz Wire.