У четвер Anthropic опублікувала свій звіт про розвідку загроз за вересень 2026 року «Виявлення та протидія зловживанням штучним інтелектом», в якому описується, як її команда Threat Intelligence виявила та знищила загрозливих суб’єктів, які зловживали Клодом у період з грудня 2025 по серпень 2026. Справи охоплюють сім різних сфер шкоди: кібероперації, операції впливу, стеження, шахрайство та шахрайство, біологічне зловживання, розробка звичайної зброї та незаконна дистиляція моделей. За словами компанії, кожна кампанія, яку вона описує, була зірвана, а розвідувальні дані були передані владі та галузевим партнерам, де це було необхідно.
Звіт припадає на момент інтенсивної перевірки індустрії штучного інтелекту, і зокрема Anthropic, оскільки [найважливіші новини штучного інтелекту] (https://aibuzzwire.news) цього тижня переважали розголошення безпеки, облікові записи інформаторів і посилення тиску з боку законодавців. Він також надходить разом зі звітами The New York Times і Politico, в яких висвітлюються спроби озброєння передових моделей, включаючи заблоковані зусилля, пов’язані з розробкою біологічної зброї.
Як Anthropic відстежує загрозливих акторів із підтримкою штучного інтелекту
Anthropic відстежує учасників у своєму звіті за внутрішніми позначеннями, відомими як Generative Threat Groups, або GTG. У кожному конкретному дослідженні вимірюється те, що компанія називає підйомом — збільшення можливостей, яке дає штучний інтелект у трьох вимірах: швидкість, масштаб і глибина. Випадки зловживання стосувалися моделей Claude Haiku, Sonnet і Opus. Жодна не стосувалася моделей класу Fable або Mythos, за винятком одного випадку незаконної дистиляції.
Anthropic розглядає свою готовність публікувати як обов’язок, а не як маркетингову вправу, зазначаючи у звіті, що «ми вважаємо, що ми зобов’язані розкривати зловмисне використання наших послуг».
Операція, пов’язана з Midnight Blizzard, яка перебудувала власне шкідливе програмне забезпечення
Наймасштабніший кіберкейс у звіті, який відслідковується як GTG-20006, описує актора, чиє приписування, за словами Anthropic, узгоджується з публічними повідомленнями, що пов’язують його з Midnight Blizzard, російською державною хакерською групою, раніше відомою як Nobelium або APT29. Один із його операторів, особа, яка використовує ручку "JackPoterz", є російськомовною.
Згідно зі звітом, цільовою групою було понад 20 організацій, зосереджених серед українських урядових, військових і дипломатичних установ. Він скомпрометував щонайменше трьох постачальників Wi-Fi у готелях, щоб викрасти записи DNS, заволодів обліковими записами WhatsApp щонайменше двох колишніх високопоставлених українських посадовців і вкрав понад 300 000 національних ідентифікаційних записів разом із даними комерційного реєстру, що охоплюють понад півмільйона компаній, у північноафриканського державного технологічного органу.
Найбільш вражаючою деталлю є автономна адаптація: Anthropic повідомляє, що агенти ШІ актора змінювали та перебудовували зловмисне програмне забезпечення групи щоразу, коли його виявляли продукти безпеки — цикл, який раніше вимагав кваліфікованих розробників на вимогу.
Масштабний збір облікових даних і автономне полювання нульового дня
Друга справа, GTG-50014, стосується операторів, підозрюваних у причетності до колективу ShinyHunters. Їхні конвеєри збирання облікових даних масово завантажили 1,8 мільйона Android APK і просканували їх на наявність жорстко закодованих секретів. Під час одного зламування постачальника технологій було викрадено понад терабайт даних, у тому числі мільйони записів платіжних карток. Інша дочірня компанія витягла дані приблизно з 200 подальших клієнтів зламаного постачальника програмного забезпечення як послуги та викинула понад 2100 наборів токенів Azure AD, що охоплюють понад 40 корпоративних орендарів, приблизно за 34 години — відповідно до звіту, майже всю роботу виконували агенти ШІ.
GTG-10007 ще більш тверезий для захисників. Anthropic приписує цей кластер китайськомовним операторам, які, ймовірно, базуються в Чанша, Хунань — двоє з яких були студентами бакалаврату — які орієнтувалися приблизно на п’ятдесят організацій і проводили автономну програму дослідження вразливостей. Один робочий процес, ітерований на мережевих пристроях, дав більше дюжини можливих результатів нульового дня за один місяць.
Вимагання, самотній хактивіст і невдалий рейд на AI Labs
Фінансово вмотивоване зловживання особливо помітно. GTG-50020, російськомовний актор, викрав приблизно 26 гігабайт в однієї жертви та вимагав від 1,5 до 2,5 мільйонів доларів США у вигляді вимагання. Потім та ж група атакувала приблизно тридцять компаній зі штучним інтелектом протягом чотирьох днів із заявленою метою отримати доступ до попередньої моделі Клода. Anthropic каже, що всі спроби не вдалися, а її власні системи ніколи не були скомпрометовані.
На іншому кінці спектру GTG-50029 був одним франкомовним хактивістом, який використовував раніше незадокументовану умову перевстановлення WordPress проти щонайменше чотирьох сайтів, отримав внутрішній доступ щонайменше до 14 із 42 відстежуваних цілей і викрадав приблизно 140 000 записів, включно з політичними поглядами користувачів із платформи кампанії. Потім актор створив платформу doxxing, fafsearch, завантажену десятками мільйонів рядків.
Операції впливу від Центральноафриканської Республіки до Малайзії
Дев'ять випадків операцій впливу в звіті виникли в Росії, Ірані, Туреччині, країнах Перської затоки, Південній Азії, Африці та Європі, їх охоплення оцінюється за шкалою прориву Інституту Брукінгса. В одному випадку GTG-04001, російськомовний актор із Бангі, створював щоденний контент для Radio Lengo Songo, станції Anthropic, пов’язаної з Політологією — Африканським корпусом і філією впливу Вагнера, яка, за її оцінками, опинилася під контролем Служби зовнішньої розвідки Росії наприкінці 2023 року. Операція створила підроблені урядові документи Центральноафриканської Республіки та трудові контракти, які вимагали лояльності до президента країни та Росії, і було оцінений як четверта категорія за шкалою.
Іншу мережу, GTG-54002, було відстежено до LKM Company, французького агентства цифрової реклами, яке керує приблизно 70 сфабрикованими новинними веб-сайтами, 70 відповідними обліковими записами X і понад 250 обліковими записами неавтентичних коментарів. У мережі було опубліковано щонайменше 8913 статей приблизно 20 мовами, 318 з них присвячені Демократичній Республіці Конго.
Ціллю також були вибори. GTG-84005, комерційна платформа для маніпулювання виборами, націлена на Малайзію, яку Anthropic пов’язала зі стамбульською BBS Bilisim Teknolojileri, керувала близько 1000 фальшивими обліковими записами X у всіх 222 парламентських округах Малайзії та сфабрикувала досьє на опозиційного політика. Окремий кластер, GTG-24015, використовував чотири облікові записи як редакційний стіл із підтримкою ШІ, який живив російські державні ЗМІ.
Чому розкриття важливо
Anthropic стверджує, що в кожному випадку порушувала діяльність, використовувала отримані дані для зміцнення своїх гарантій і передавала розвідувальні дані владі та галузевим партнерам, де це було необхідно. Публікація детальних прикладів — разом із аналізом помилок власних виявлень — залишається рідкістю серед передових лабораторій, і компанія стверджує, що прозорість підвищує базовий рівень для всієї галузі.
У звіті також підкреслюється зміна, яку служби безпеки більше не можуть ігнорувати: найнебезпечніші операції з підтримкою ШІ, описані тут, були не гіпотетичними демонстраціями, а живими кампаніями проти урядів, компаній і виборів. У міру того, як моделі стають дедалі ефективнішими, дані Anthropic свідчать про те, що піднесення, яке вони забезпечують рішучим супротивникам, посилюється — і найкраща доступна відповідь захисників наразі — це видимість, розкриття інформації та швидша ітерація захисних заходів.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →