Anthropic publicó el jueves su informe de inteligencia de amenazas de septiembre de 2026, "Detectar y contrarrestar el uso indebido de la IA", que describe cómo su equipo de Inteligencia de Amenazas identificó e interrumpió a los actores de amenazas que abusaron de Claude entre diciembre de 2025 y agosto de 2026. Los casos abarcan siete áreas de daño distintas: operaciones cibernéticas, operaciones de influencia, vigilancia, estafas y fraude, uso indebido de productos biológicos, desarrollo de armas convencionales y destilación de modelos ilícitos. Según la empresa, todas las campañas que describe fueron interrumpidas y, cuando correspondía, se compartió información de inteligencia con las autoridades y socios de la industria.

El informe llega en un momento de intenso escrutinio para la industria de la IA, y para Anthropic en particular, ya que las últimas noticias sobre IA de esta semana han estado dominadas por revelaciones de seguridad, relatos de denunciantes y una creciente presión por parte de los legisladores. También llega junto con informes de The New York Times y Politico que destacan los intentos de convertir en armas modelos fronterizos, incluidos los esfuerzos bloqueados relacionados con el desarrollo de armas biológicas.

Cómo Anthropic rastrea a los actores de amenazas habilitados por IA

Anthropic rastrea a los actores en su informe bajo designadores internos conocidos como Grupos de Amenaza Generativa o GTG. Cada estudio de caso mide lo que la empresa llama uplift: el aumento de capacidad que la IA brinda a una operación en tres dimensiones: velocidad, escala y profundidad. Los casos de uso indebido involucraron a los modelos Claude Haiku, Sonnet y Opus. Ninguno involucró a los modelos clase Fable o Mythos de la compañía, con la excepción de un caso de destilación ilícita.

Anthropic enmarca su voluntad de publicar como un deber más que como un ejercicio de marketing, afirmando en el informe que "creemos que tenemos la responsabilidad de revelar el uso indebido malicioso de nuestros servicios".

Una operación vinculada a Midnight Blizzard que reconstruyó su propio malware

El caso cibernético más extenso del informe, rastreado como GTG-20006, describe a un actor cuya atribución, según Anthropic, es consistente con informes públicos que lo vinculan con Midnight Blizzard, el grupo de piratería alineado con el estado ruso anteriormente conocido como Nobelium o APT29. Uno de sus operadores, un individuo que utiliza el alias "JackPoterz", habla ruso.

Según el informe, el grupo atacó a más de 20 organizaciones, concentradas entre el gobierno, el ejército y los órganos diplomáticos de Ucrania. Comprometió al menos a tres proveedores de WiFi de hoteles para secuestrar registros DNS, se apoderó de las cuentas de WhatsApp de al menos dos ex funcionarios ucranianos de alto nivel y robó más de 300.000 registros de identidad nacionales junto con datos de registros comerciales que cubren más de medio millón de empresas de una autoridad tecnológica del gobierno del norte de África.

El detalle más sorprendente es la adaptación autónoma: Anthropic informa que los agentes de inteligencia artificial del actor modificaban y reconstruían el malware del grupo cada vez que los productos de seguridad lo detectaban, un bucle que anteriormente habría requerido desarrolladores capacitados bajo demanda.

Recolección de credenciales a escala y caza autónoma de día cero

Un segundo caso, GTG-50014, abarca a operadores sospechosos de afiliación al colectivo ShinyHunters. Sus canales de recolección de credenciales descargaron masivamente 1,8 millones de APK de Android y los escanearon en busca de secretos codificados. En un compromiso de un proveedor de tecnología, se extrajo más de un terabyte de datos, incluidos millones de registros de tarjetas de pago. Otro afiliado extrajo datos de aproximadamente 200 clientes intermedios de un proveedor de software como servicio violado y descartó más de 2100 conjuntos de tokens de Azure AD que abarcaban más de 40 inquilinos corporativos en aproximadamente 34 horas, y los agentes de IA realizaron casi todo el trabajo, según el informe.

GTG-10007 es aún más aleccionador para los defensores. Anthropic atribuye este grupo a operadores de habla china probablemente con sede en Changsha, Hunan (dos de los cuales identificó como estudiantes universitarios) que se dirigieron a aproximadamente cincuenta organizaciones y ejecutaron un programa autónomo de investigación de vulnerabilidades. Un flujo de trabajo, que se iteraba en dispositivos de red, arrojó más de una docena de posibles hallazgos de día cero en un solo mes.

Extorsión, un hacktivista solitario y una redada fallida en laboratorios de inteligencia artificial

El mal uso por motivos financieros ocupa un lugar destacado. GTG-50020, un actor de habla rusa, exfiltró aproximadamente 26 gigabytes de una víctima y buscó entre 1,5 y 2,5 millones de dólares en extorsión. Luego, el mismo grupo atacó a unas treinta empresas de inteligencia artificial en unos cuatro días con el objetivo declarado de acceder a un modelo de Claude previo al lanzamiento. Anthropic dice que todos los intentos fracasaron y sus propios sistemas nunca se vieron comprometidos.

En el otro extremo del espectro, GTG-50029 era un hacktivista de habla francesa que aprovechó una condición de carrera de reinstalación de WordPress previamente indocumentada contra al menos cuatro sitios, obtuvo acceso interno a al menos 14 de los 42 objetivos rastreados y exfiltró aproximadamente 140.000 registros, incluidas las opiniones políticas de los usuarios de una plataforma de campaña. Luego, el actor construyó una plataforma de doxxing, fafsearch, cargada con decenas de millones de filas.

Operaciones de influencia desde la República Centroafricana hasta Malasia

Nueve casos de operaciones de influencia incluidos en el informe se originaron en Rusia, Irán, Turquía, el Golfo, el sur de Asia, África y Europa, y su alcance se midió según la escala de ruptura de la Brookings Institution. En un caso, GTG-04001, un actor de habla rusa radicado en Bangui, produjo contenido diario para Radio Lengo Songo, una estación Anthropic vinculada a Politología: la rama de influencia del Cuerpo de África y Wagner que, según su evaluación, quedó bajo el control del Servicio de Inteligencia Exterior de Rusia a fines de 2023. La operación produjo documentos gubernamentales y contratos de trabajo falsificados del gobierno de la República Centroafricana que exigían lealtad al presidente del país y a Rusia, y fue evaluado como Categoría Cuatro en la escala.

Otra red, GTG-54002, fue rastreada hasta LKM Company, una agencia de publicidad digital con sede en Francia que opera aproximadamente 70 sitios web de noticias inventados, 70 cuentas X coincidentes y más de 250 cuentas de comentarios no auténticas. La red publicó al menos 8.913 artículos en unos 20 idiomas, 318 de ellos centrados en la República Democrática del Congo.

Las elecciones también fueron un objetivo. GTG-84005, una plataforma comercial de manipulación electoral dirigida a Malasia que Anthropic vinculó a BBS Bilisim Teknolojileri, con sede en Estambul, gestionó alrededor de 1.000 cuentas X falsas en los 222 distritos electorales parlamentarios de Malasia y fabricó expedientes contra un político de la oposición. Un grupo separado, GTG-24015, utilizó cuatro cuentas como una mesa editorial asistida por IA que alimentaba a los medios estatales rusos.

Por qué es importante la divulgación

Anthropic dice que interrumpió la actividad en cada caso, utilizó los hallazgos para fortalecer sus salvaguardas y compartió inteligencia con las autoridades y socios de la industria cuando correspondió. La publicación de estudios de casos detallados, completos con análisis de fallas de sus propias detecciones, sigue siendo poco común entre los laboratorios de vanguardia, y la compañía sostiene que la transparencia eleva la base para toda la industria.

El informe también subraya un cambio que los equipos de seguridad ya no pueden ignorar: las operaciones más peligrosas basadas en IA descritas aquí no fueron manifestaciones hipotéticas sino campañas en vivo contra gobiernos, empresas y elecciones. A medida que los modelos se vuelven más capaces, los datos de Anthropic sugieren que el beneficio que brindan a determinados adversarios se está agravando, y la mejor respuesta disponible de los defensores, por ahora, es la visibilidad, la divulgación y una iteración más rápida de las salvaguardas.

---

Manténgase a la vanguardia de la IA

Obtenga las últimas noticias, análisis y avances en IA, todo en un solo lugar.

Leer más noticias sobre IA →