В четверг Anthropic опубликовала отчет об угрозах «Обнаружение и противодействие неправомерному использованию ИИ» за сентябрь 2026 года, в котором описывается, как ее команда Threat Intelligence выявила и пресекла действия злоумышленников, которые злоупотребляли Клодом в период с декабря 2025 года по август 2026 года. Случаи охватывают семь различных областей вреда: кибероперации, операции влияния, наблюдение, мошенничество и мошенничество, биологическое злоупотребление, разработка обычных вооружений и незаконная дистилляция моделей. По данным компании, каждая описываемая ею кампания была сорвана, а разведданные передавались властям и отраслевым партнерам, где это было необходимо.

Отчет появился в момент пристального внимания к индустрии искусственного интеллекта и, в частности, к Anthropic, поскольку последние новости искусственного интеллекта на этой неделе преобладали раскрытия информации о безопасности, сообщения осведомителей и растущее давление со стороны законодателей. Оно также появляется вместе с репортажами The New York Times и Politico, в которых освещаются попытки использовать пограничные модели в качестве оружия, включая заблокированные усилия, связанные с разработкой биологического оружия.

Как Anthropic отслеживает злоумышленников с помощью искусственного интеллекта

В своем отчете Anthropic отслеживает участников под внутренними обозначениями, известными как группы генеративных угроз или GTG. В каждом тематическом исследовании измеряется то, что компания называет подъемом — повышение возможностей, которое ИИ дает операции в трех измерениях: скорость, масштаб и глубина. Случаи неправомерного использования касались моделей Claude Haiku, Sonnet и Opus. Ни один из них не касался моделей компании класса Fable или Mythos, за исключением одного случая незаконной перегонки.

Anthropic формулирует свою готовность публиковаться как обязанность, а не маркетинговое мероприятие, заявляя в отчете, что «мы считаем, что несем ответственность за раскрытие злонамеренного злоупотребления нашими услугами».

Операция, связанная с Midnight Blizzard, которая переработала собственное вредоносное ПО

Самый обширный кибер-случай в отчете, обозначенный как GTG-20006, описывает злоумышленника, чья атрибуция, по словам Anthropic, соответствует публичным сообщениям, связывающим его с Midnight Blizzard, российской государственной хакерской группой, ранее известной как Nobelium или APT29. Один из ее операторов, физическое лицо, использующее никнейм JackPoterz, говорит по-русски.

Согласно отчету, группа атаковала более 20 организаций, сосредоточенных в украинских правительственных, военных и дипломатических органах. Он скомпрометировал как минимум трех поставщиков Wi-Fi в отелях, чтобы похитить записи DNS, завладел учетными записями WhatsApp как минимум двух бывших высокопоставленных украинских чиновников и украл более 300 000 национальных идентификационных записей, а также данные коммерческого реестра, охватывающие более полумиллиона компаний, из государственного технологического органа Северной Африки.

Самая яркая деталь — автономная адаптация: Anthropic сообщает, что ИИ-агенты злоумышленника модифицировали и перестраивали вредоносное ПО группы всякий раз, когда продукты безопасности обнаруживали его — цикл, который раньше требовал бы квалифицированных разработчиков по запросу.

Масштабный сбор учетных данных и автономный поиск нулевого дня

Второе дело, GTG-50014, касается операторов, подозреваемых в принадлежности к коллективу ShinyHunters. Их конвейеры сбора учетных данных массово загрузили 1,8 миллиона APK-файлов Android и просканировали их на наличие жестко запрограммированных секретов. В ходе одной из атак поставщика технологий было похищено более терабайта данных, включая миллионы записей платежных карт. Другой филиал получил данные примерно от 200 последующих клиентов взломанного поставщика программного обеспечения как услуги и сбросил более 2100 наборов токенов Azure AD, охватывающих более 40 корпоративных клиентов, примерно за 34 часа — при этом агенты искусственного интеллекта выполнили почти всю работу, согласно отчету.

GTG-10007 еще более отрезвляет защитников. Anthropic связывает этот кластер с китайскоязычными операторами, вероятно, базирующимися в Чанше, провинция Хунань, двое из которых были идентифицированы как студенты бакалавриата, которые атаковали примерно пятьдесят организаций и провели автономную программу исследования уязвимостей. Один рабочий процесс, включающий в себя сетевые устройства, позволил получить более дюжины возможных результатов нулевого дня за один месяц.

Вымогательство, одинокий хактивист и неудавшийся рейд на лаборатории искусственного интеллекта

Заметное место занимает финансово мотивированное злоупотребление. GTG-50020, русскоязычный актер, похитил примерно 26 гигабайт у одной жертвы и потребовал вымогательства от 1,5 до 2,5 миллионов долларов. Затем та же группа примерно за четыре дня атаковала примерно тридцать компаний, занимающихся искусственным интеллектом, с заявленной целью получить доступ к предварительной версии модели Claude. Anthropic утверждает, что все попытки взлома провалились, а ее собственные системы ни разу не были скомпрометированы.

На другом конце спектра находился GTG-50029, одинокий франкоязычный хактивист, который воспользовался ранее недокументированным состоянием гонки переустановки WordPress как минимум на четырех сайтах, получил внутренний доступ как минимум к 14 из 42 отслеживаемых целей и украл примерно 140 000 записей, включая политические мнения пользователей, с платформы предвыборной кампании. Затем актер создал платформу доксинга fafsearch, загруженную десятками миллионов строк.

Операции влияния от Центральноафриканской Республики до Малайзии

Девять случаев операций влияния, упомянутых в отчете, возникли в России, Иране, Турции, Персидском заливе, Южной Азии, Африке и Европе, а охват измерялся по шкале прорыва Брукингского института. В одном случае GTG-04001, русскоязычный актер, базирующийся в Банги, производил ежедневный контент для Radio Lengo Songo, станции Anthropic, связанной с «Политологией» — Африканским корпусом и отделением влияния Вагнера, которое, по его оценке, перешло под контроль Службы внешней разведки России в конце 2023 года. В ходе операции были получены поддельные правительственные документы Центральноафриканской Республики и трудовые договоры, подтверждающие лояльность президенту страны и России, и она была оценена как четвертая категория по шкале.

Другая сеть, GTG-54002, была отслежена до LKM Company, французского агентства цифровой рекламы, управляющего примерно 70 сфабрикованными новостными веб-сайтами, 70 совпадающими учетными записями X и более 250 учетными записями недостоверных комментариев. Сеть опубликовала не менее 8913 статей примерно на 20 языках, 318 из них были посвящены Демократической Республике Конго.

Выборы также были целью. GTG-84005, коммерческая платформа для манипулирования выборами, нацеленная на Малайзию, которую Anthropic связала со стамбульской BBS Bilisim Teknolojileri, управляла около 1000 фейковыми аккаунтами X во всех 222 парламентских округах Малайзии и сфабриковала досье против оппозиционного политика. Отдельный кластер GTG-24015 использовал четыре аккаунта в качестве редакционной службы с помощью искусственного интеллекта, снабжающей российские государственные СМИ информацией.

Почему раскрытие информации имеет значение

Anthropic заявляет, что в каждом случае пресекала деятельность, использовала полученные данные для усиления своих мер безопасности и при необходимости делилась разведданными с властями и отраслевыми партнерами. Публикация подробных тематических исследований, дополненных анализом ошибок собственных обнаружений, остается редкостью среди передовых лабораторий, и компания утверждает, что прозрачность повышает базовый уровень для всей отрасли.

В докладе также подчеркивается сдвиг, который службы безопасности больше не могут игнорировать: наиболее опасные операции с использованием искусственного интеллекта, описанные здесь, были не гипотетическими демонстрациями, а реальными кампаниями против правительств, компаний и выборов. По мере того, как модели становятся более функциональными, данные Anthropic показывают, что поддержка, которую они оказывают решительным противникам, усугубляется, и лучший доступный ответ для защитников на данный момент — это прозрачность, раскрытие информации и более быстрое внедрение мер безопасности.

---

Будьте впереди ИИ

Получайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

Подробнее новости AI →