Во вторник Anthropic объявила о значительном расширении своих усилий по модели доступа, ориентированных на безопасность, реструктурируя свою инициативу проверенного доступа в официальную программу кибер-верификации (CVP) с тремя отдельными уровнями для специалистов по кибербезопасности. Этот шаг был предпринят после того, как компания сообщила, что с апреля в рамках ее инициативы Project Glasswing было обнаружено не менее 129 000 проверенных уязвимостей программного обеспечения.

Реструктурированная программа позволяет проверенным группам безопасности запускать наиболее эффективные модели Anthropic, включая Claude Opus 5.5, Claude Sonnet 5.5 и Claude Mythos 5.1, с пониженными мерами защиты и блокирующими классификаторами — разрешениями, которые обычно недоступны обычным пользователям. По мнению Anthropic, цель состоит в том, чтобы передать передовые возможности искусственного интеллекта в руки защитников, прежде чем злоумышленники начнут использовать те же инструменты в качестве оружия. Подробнее об этой истории — в нашем тенденции ИИ.

Три уровня доступа, три сценария угроз

Новая программа организована вокруг трех уровней доступа, каждый из которых предназначен для определенного типа работы по обеспечению безопасности:

  • Защитный доступ охватывает защитные операции, такие как реагирование на инциденты, обратный инжиниринг вредоносного ПО, а также анализ и проверку уязвимостей.
  • Red Team Access добавляет авторизованное тестирование на проникновение и «красную команду» к сценариям оборонительного использования, позволяя моделировать атаки на системы, на тестирование которых у организаций есть разрешение.
  • Специализированный доступ обеспечивает наименьшие меры безопасности и зарезервирован для ограниченного числа проверенных организаций, которые уполномочены самостоятельно тестировать системы безопасности искусственного интеллекта.

Организации и отдельные группы безопасности подают заявки на уровень, соответствующий их работе, и Anthropic проверяет каждую заявку, прежде чем предоставить доступ. Компания заявила, что все три уровня включают доступ к текущим флагманским моделям, а также к новым моделям, которые будут выпущены в будущем.

Защитные меры по-прежнему эффективны — выборочно

Anthropic объединил это объявление с оценочными данными, призванными показать, что многоуровневая система отделяет безобидную оборонительную работу от действительно опасных возможностей. В ходе оценки CyScenarioBench Claude Opus 5.5 компания сообщила, что средства защиты заблокировали 46 из 50 задач на уровне защитного доступа. На уровне Red Team Access для той же модели ни одна задача не была заблокирована, и модель выполнила 34 из 50 — такой же показатель завершения, зафиксированный при отсутствии каких-либо мер безопасности.

Напротив, по данным Anthropic, без доступа CVP каждая задача блокировалась при первом же запросе.

«Эти оценки вселяют в нас уверенность в том, что мы можем сделать передовые кибервозможности безопасно доступными для более широкого круга защитников, расширяя оборонительные усилия, которые мы начали с Project Glasswing», — заявила компания в своем заявлении, которое широко освещалось The Hacker News, Reuters и SecurityWeek.

Дизайн отражает ставку на то, что большая часть защитной работы по обеспечению безопасности — установка исправлений, анализ журналов, сортировка вредоносных программ — может осуществляться под строгими барьерами, в то время как законное наступательное тестирование требует более широкого коридора. Это также отражает то, как индустрия безопасности уже давно обращается с инструментами двойного назначения: проверяйте специалиста, а не только инструмент.

Расширение присутствия Glasswing

Расширение программы тесно связано с Project Glasswing, инициативой Anthropic по применению своих моделей для усиления защиты критически важного программного обеспечения. Компания заявила, что Glasswing обнаружила не менее 129 000 проверенных уязвимостей программного обеспечения в период с апреля по июль 2026 года и еще 5500 проверенных уязвимостей в период с апреля по октябрь благодаря усилиям по сканированию открытого исходного кода.

Из проверенных уязвимостей более 33 000 к настоящему времени были оценены как критические или высокой степени серьезности — эта цифра, по мнению Anthropic, вероятно, является значительным занижением, поскольку она опирается на данные опросов только от части партнеров Glasswing. По оценкам компании, истинное воздействие может быть как минимум в пять раз выше.

Взвешенный взгляд на обнаружение уязвимостей с помощью ИИ

Независимый анализ показывает, что поток обнаруженных ИИ недостатков не приводит непосредственно к соответствующей волне использованных нарушений. В анализе, опубликованном в конце прошлого месяца, исследователь VulnCheck Патрик Гаррити обнаружил, что только 2 из 300 уязвимостей, обнаруженных Anthropic или Project Glasswing, — примерно 0,67 процента — были использованы в реальных условиях.

Двумя эксплуатируемыми уязвимостями являются CVE-2026-26980, уязвимость внедрения SQL в Ghost CMS, и CVE-2026-61500, уязвимость подделки сеанса в HTTP-файловом сервере Rejetto. Данные подтверждают нюанс, который подчеркивают исследователи в области безопасности: ИИ снижает барьер для обнаружения уязвимостей, но большинство обнаруженных им недостатков никогда не попадали в поле зрения злоумышленников.

Это объявление также прозвучало на фоне более широких дебатов о работе в области безопасности, создаваемой ИИ. Исследования 1Password и Veracode показали, что исправления уязвимостей, написанные ИИ, сами по себе могут создавать новые недостатки, подчеркивая, что автоматизация помогает, но не заменяет проверку человеком.

Что это значит для индустрии безопасности

Для групп безопасности CVP снижает энергию активации для использования пограничных моделей в реальной оборонительной работе. Лица, реагирующие на инциденты, получают санкционированный путь к помощи в анализе вредоносного ПО; тестеры на проникновение получают управляемую среду для атак с помощью ИИ; а небольшая группа организаций, сами проверяющих системы безопасности ИИ, получают наименее ограниченный доступ.

Для Anthropic программа является одновременно стратегией безопасности и коммерческой. Это конкретизирует позицию компании о том, что мощные кибервозможности следует предоставлять проверенным защитникам намеренно, а не полностью подавлять — в отличие от конкурентов, которые столкнулись с пристальным вниманием к моделям с более слабым киберконтролем. Это также углубляет отношения Anthropic с предприятиями, которые, скорее всего, будут платить за доступ к передовой модели: правительствами, операторами критически важной инфраструктуры и крупными поставщиками средств безопасности.

Компания не объявила об изменениях цен, связанных с программой, а заявки обрабатываются через существующие каналы проверенного доступа Anthropic. Учитывая масштаб того, что Glasswing уже обнаружил, а также признание самой компании, что цифры, скорее всего, занижают реальность, индустрия безопасности будет следить за тем, сколько из этих 129 000 находок будет исправлено до того, как злоумышленники обнаружат их первыми.

---

Будьте в курсе ИИ

Последние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.

Читать больше новостей об ИИ →