OpenAI ha elevado la recompensa por descubrir "jailbreaks universales" en sus modelos de IA a 50.000 dólares, más del doble de la recompensa anterior y señala que la compañía considera que ciertas clases de evasiones de seguridad son lo suficientemente graves como para justificar un pago premium.
El programa Bio Bug Bounty actualizado, anunciado por OpenAI el 9 de julio de 2026, pide a los investigadores de seguridad que encuentren indicaciones que puedan romper universalmente las barreras de seguridad del modelo: omisiones que funcionan en múltiples conversaciones y contextos en lugar de casos extremos aislados. El programa se dirige específicamente a fugas relacionadas con amenazas biológicas, donde se podría obligar a un modelo de IA a proporcionar orientación práctica sobre la creación de patógenos o armas peligrosos.
Para obtener más noticias de última hora sobre IA y análisis en profundidad, visite AI Buzz Wire.
¿Por qué 50.000 dólares?
El aumento de la recompensa refleja una creciente preocupación por la brecha entre lo que a los modelos de IA fronterizos se les dice que no hagan y lo que los usuarios determinados realmente pueden extraer de ellos. Un jailbreak universal es particularmente peligroso porque, a diferencia de un truco de inyección puntual, representa una debilidad sistemática que puede replicarse y compartirse.
TechRepublic informó el 10 de julio que el aumento de la recompensa se produce en medio de un mayor escrutinio de los modelos más potentes de OpenAI. La administración Trump pidió previamente a OpenAI que limitara el lanzamiento de su modelo más nuevo con capacidad cibernética a un grupo cuidadosamente seleccionado de usuarios examinados, según National Technology News, lo que refleja la preocupación del gobierno sobre el potencial ofensivo de los sistemas de inteligencia artificial fronterizos.
Agencia del Reino Unido descubre que las capacidades cibernéticas de IA se están acelerando
El anuncio de la recompensa coincide con una severa advertencia del Instituto de Seguridad de IA (AISI) del Reino Unido, que ha estado evaluando de forma independiente las capacidades cibernéticas de los modelos fronterizos desde 2024.
En una evaluación de abril de 2026 del GPT-5.5 de OpenAI, el AISI descubrió que el modelo logró una tasa de aprobación del 71,4 % en tareas de ciberseguridad de nivel experto, la más alta de cualquier modelo probado, superando a Claude Mythos Preview de Anthropic con un 68,6 %, GPT-5.4 con un 52,4 % y Opus 4.7 con un 48,6 %.
Un punto de referencia fue particularmente sorprendente. AISI diseñó un desafío de ingeniería inversa de máquina virtual personalizado: una tarea de varios pasos que requiere que un atacante cree un decodificador de instrucciones personalizado, realice ingeniería inversa en un autenticador y recupere una contraseña válida. El experto probador humano de Crystal Peak Security resolvió el desafío en aproximadamente 12 horas utilizando herramientas profesionales. GPT-5.5 lo resolvió en 10 minutos y 22 segundos a un costo de $1,73 en uso de API, sin asistencia humana.
Duplicar cada pocos meses
En un análisis separado publicado en mayo de 2026, el AISI descubrió que la duración de las tareas cibernéticas que los modelos de IA de frontera pueden completar de forma autónoma se ha duplicado cada 4,7 meses desde finales de 2024, una aceleración con respecto a su estimación de ocho meses de noviembre de 2025.
"El ritmo actual de cambio indica un potencial creciente para que las capacidades cibernéticas de la IA se traduzcan en riesgos tangibles: riesgos que las organizaciones del Reino Unido deberán afrontar en los próximos meses", escribió el AISI.
Claude Mythos Preview y GPT-5.5 superaron sustancialmente la tendencia de duplicación anterior, lo que plantea la cuestión de si el ritmo se está acelerando aún más.
Jailbreaks universales: lo que está en juego
La distinción entre un jailbreak restringido y uno universal es fundamental. Un jailbreak limitado podría engañar a un modelo para que produzca una única respuesta no permitida en condiciones específicas. Un jailbreak universal, por el contrario, representa una grieta fundamental en la arquitectura de seguridad del modelo, un método que elude de manera confiable las barreras de seguridad en una amplia gama de entradas.
La decisión de OpenAI de ofrecer 50.000 dólares por tales descubrimientos sugiere que la compañía cree que los jailbreak universales son lo suficientemente raros como para justificar una gran recompensa y lo suficientemente peligrosos como para justificar la inversión. Si un actor malintencionado descubriera un jailbreak universal para consultas relacionadas con amenazas biológicas antes de aplicar el parche, las consecuencias podrían ser graves.
El programa también cumple una función de transparencia. Al invitar a investigadores externos a probar sus modelos, OpenAI puede identificar y corregir vulnerabilidades antes de que sean explotadas en la naturaleza, siempre que la recompensa sea lo suficientemente grande como para atraer el calibre del talento necesario.
Una carrera entre ataque y defensa
Los acontecimientos paralelos (el aumento de las recompensas de OpenAI y las evaluaciones de capacidad de AISI) ilustran la tensión central en la seguridad de la IA en la actualidad. Los modelos se están volviendo dramáticamente más capaces en tareas cibernéticas, y el horizonte temporal de las tareas que pueden completar se duplica cada pocos meses. Al mismo tiempo, las empresas se apresuran a reparar las vulnerabilidades que hacen que sus modelos sean peligrosos.
Sigue siendo una cuestión abierta si las recompensas y los equipos rojos pueden seguir el ritmo de la curva de capacidad acelerada. Pero la cifra de 50.000 dólares envía una señal clara: OpenAI cree que la amenaza es lo suficientemente grave como para pagar mucho dinero a cualquiera que pueda demostrar que existen las grietas.
Manténgase por delante de la IA
A medida que los modelos de frontera se vuelven más poderosos, la batalla entre las barreras de seguridad y quienes intentan romperlas no hará más que intensificarse. Siga los últimos desarrollos en AI Buzz Wire.
Lea más cobertura de la industria de la IA en AI Buzz Wire.


