La iniciativa Proyecto Glasswing de Anthropic ha verificado al menos 129.000 vulnerabilidades de software entre abril y julio de 2026, de las cuales más de 33.000 fueron clasificadas como críticas o de alta gravedad, reveló la compañía el martes junto con una expansión de sus programas de acceso de seguridad. Pero un análisis independiente de los hallazgos cuenta una historia sorprendente: casi ninguno de los fallos descubiertos por la IA ha aparecido en ataques del mundo real.
La escala del descubrimiento impulsado por la IA Para más contexto sobre esta historia, consulta nuestra noticias de IA.
Los totales de vulnerabilidad provienen de la propia contabilidad de Anthropic del Proyecto Glasswing, la iniciativa que lanzó en abril para aplicar sus modelos de frontera Claude para reforzar el software crítico. Además de las 129.000 vulnerabilidades verificadas encontradas por los socios de Glasswing, la compañía dijo que un esfuerzo de escaneo de código abierto descubrió otras 5.500 vulnerabilidades verificadas entre abril y octubre de 2026.
Anthropic advirtió que las cifras de gravedad probablemente sean un recuento significativamente insuficiente. Las más de 33.000 calificaciones críticas y de alta gravedad se basan en datos de encuestas de sólo un subconjunto de socios de Glasswing, y la compañía estima que el verdadero impacto podría ser al menos cinco veces mayor.
A modo de contexto, la Base de datos nacional de vulnerabilidades de EE. UU. ha registrado en los últimos años aproximadamente entre 28.000 y 40.000 nuevos CVE anualmente en todo el ecosistema de software global. Un único programa impulsado por IA que ha revelado más de 129.000 problemas verificados en aproximadamente tres meses indica cuán dramáticamente modelos como Claude Opus 5.5 y Claude Mythos 5.1 están cambiando la economía de la investigación en seguridad.
La brecha de explotación
El hallazgo más provocativo proviene de fuera de Anthropic. En un análisis publicado a finales de septiembre, el investigador de VulnCheck, Patrick Garrity, examinó 300 vulnerabilidades acreditadas a Anthropic o Project Glasswing y descubrió que sólo 2 (aproximadamente el 0,67 por ciento) habían sido explotadas en estado salvaje.
La distribución de gravedad de esas 300 vulnerabilidades se desglosa en 39 críticas, 141 altas, 81 medias y 18 bajas. Sin embargo, los dos que atrajeron la explotación activa fueron clásicos poco glamorosos:
- CVE-2026-26980, una falla de inyección SQL en Ghost CMS, la popular plataforma de publicación de código abierto.
- CVE-2026-61500, una falla de falsificación de sesión en Rejetto HTTP File Server, una herramienta para compartir archivos ampliamente implementada.
Ambos son los tipos de vulnerabilidades de aplicaciones web de cola larga que los escáneres masivos y los atacantes oportunistas han buscado durante décadas. Ninguno de los dos requería capacidad de modelo fronterizo para armarse, que es precisamente el punto que señalan los datos. La IA está sacando a la luz enormes volúmenes de fallas que los atacantes nunca se molestaron en buscar, y las fallas que se explotan en la práctica todavía están dominadas por patrones de ataque muy gastados contra el software expuesto a Internet.
Por qué es importante la brecha
La brecha de explotación es doble para los defensores. Por un lado, sugiere que el descubrimiento impulsado por la IA va por delante de la adopción por parte de los atacantes: los defensores que solucionan los problemas encontrados por la IA están solucionando vulnerabilidades que de otro modo habrían permanecido ocultas durante años. Por otro lado, advierte que el cuello de botella en materia de seguridad está cambiando. Cuando el descubrimiento se vuelve casi gratuito, la clasificación, la distribución de parches y la verificación se convierten en recursos escasos.
"No todos los fallos de seguridad que la IA descubre son necesariamente explotables por actores de amenazas o capaces de causar impactos significativos", como resumió The Hacker News los hallazgos de VulnCheck en su cobertura del martes sobre la divulgación.
También hay una señal de precaución adjunta al lado de remediación de la ecuación. La investigación de 1Password y Veracode ha demostrado que los parches de vulnerabilidad generados por IA pueden por sí mismos introducir nuevos fallos, lo que significa que la industria no puede simplemente señalar los modelos a una cola CVE y considerar el problema resuelto. La verificación humana sigue siendo esencial en cada paso.
Recepción del ecosistema
Glasswing ha atraído la atención mucho más allá de la base de clientes de Anthropic. Cloudflare, uno de los socios del programa, publicó su propio relato sobre su trabajo con la iniciativa en mayo, describiendo los modelos que surgieron en la infraestructura que opera. Los comentaristas de seguridad, incluido el criptógrafo Bruce Schneier, han seguido las actualizaciones del programa, y el anuncio inicial generó una de las mayores discusiones sobre Hacker News de la primavera.
La cifra de explotación del 0,67 por ciento es en sí misma notable en la economía de la vulnerabilidad. Los análisis históricos de la explotación de CVE muestran consistentemente que solo una pequeña fracción de las vulnerabilidades reveladas se aprovechan en los ataques observados, pero el gran volumen que Glasswing está agregando significa que incluso una pequeña fracción explotada representa incidentes reales, y cada falla sin parchear en el software de Internet es un billete de lotería para los atacantes oportunistas.
Del programa de investigación a la realidad operativa
El Proyecto Glasswing comenzó en abril de 2026 con el objetivo de proteger el software crítico para la era de la IA, y sus actualizaciones iniciales informaron de un rápido progreso en la búsqueda de problemas de seguridad de la memoria y fallas en las aplicaciones web. El programa ahora se encuentra en el centro de la estrategia de seguridad más amplia de Anthropic, junto con el Programa de Verificación Cibernética recientemente reestructurado que brinda a los equipos de seguridad examinados acceso escalonado a modelos con salvaguardias reducidas.
La revelación de Anthropic de que el impacto informado por los socios "es probablemente un recuento insuficiente" también insinúa el retraso en la presentación de informes inherente a la divulgación coordinada de vulnerabilidades. Es de suponer que muchos de los 129.000 hallazgos todavía están pasando por los ciclos de parches de los proveedores, un proceso que tradicionalmente lleva meses y, a la escala que está produciendo Glasswing, puede sobrecargar la propia infraestructura de divulgación.
Para los equipos de seguridad que deciden dónde invertir el escaso esfuerzo de parcheo, la explotación todavía se concentra en una pequeña cantidad de clases de errores que se encuentran en Internet y que son fácilmente utilizables como armas (entre ellas fallas de inyección SQL y manejo de sesiones), mientras que la larga cola de problemas encontrados por la IA espera en la cola.
Para los mantenedores de software, el mensaje es contundente: la era en la que los defectos oscuros podían permanecer oscuros con seguridad está llegando a su fin. Para los equipos de seguridad que deciden dónde invertir el escaso esfuerzo de parcheo, los datos de VulnCheck ofrecen una guía contraria a la intuición: la acumulación de vulnerabilidades encontradas por la IA es enorme, pero la explotación aún se concentra en una pequeña cantidad de clases de errores que se encuentran en Internet y que son fáciles de convertir en armas.
Las cifras de los primeros seis meses de Glasswing dejan una cosa clara: la IA no sólo se ha unido a la carrera por descubrir vulnerabilidades, sino que ha superado la escala en la que se medía la carrera. Lo que queda por ver es si la aplicación de parches, la divulgación y la explotación pueden seguir el ritmo del descubrimiento, o si la lista de tareas pendientes de la industria simplemente crece más rápido de lo que cualquiera puede resolverla.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →