Anthropic оголосив у вівторок про значне розширення своїх зусиль, орієнтованих на безпеку моделі доступу, реструктуризувавши свою ініціативу перевіреного доступу в офіційну програму кіберперевірки (CVP) з трьома різними рівнями для професіоналів з кібербезпеки. Цей крок стався після того, як компанія оголосила, що її ініціатива Project Glasswing виявила щонайменше 129 000 перевірених уразливостей програмного забезпечення з квітня.

Реструктуризована програма дозволяє перевіреним групам безпеки запускати найефективніші моделі Anthropic — включаючи Claude Opus 5.5, Claude Sonnet 5.5 і Claude Mythos 5.1 — зі зниженими гарантіями та класифікаторами блокування, дозволами, які зазвичай недоступні для звичайних користувачів. За словами Anthropic, мета полягає в тому, щоб передати передові можливості штучного інтелекту в руки захисників до того, як зловмисники використають ті самі інструменти. For more context on this story, see our ongoing AI industry coverage.

Три рівні доступу, три сценарії загроз

Нова програма організована навколо трьох рівнів доступу, кожен з яких адаптований до різного типу роботи з безпеки:

  • Доступ до захисту охоплює такі захисні операції, як реагування на інциденти, зворотне проектування зловмисного програмного забезпечення, аналіз і перевірка вразливостей.
  • Red Team Access додає авторизоване тестування на проникнення та red-teaming до варіантів захисного використання, що дозволяє імітувати атаки на системи, на тестування яких організації мають дозвіл.
  • Спеціалізований доступ забезпечує найменшу кількість гарантій і зарезервовано для обмеженого кола перевірених організацій, які мають право самостійно тестувати системи безпеки ШІ.

Організації та окремі групи безпеки подають заявку на рівень, який відповідає їхній роботі, і Anthropic розглядає кожну заявку, перш ніж надати доступ. Компанія повідомила, що всі три рівні включають доступ до поточних флагманських моделей, а також нових моделей, випущених у майбутньому.

Запобіжні заходи все ще кусаються — вибірково

Anthropic поєднав оголошення з даними оцінки, щоб показати, що система рівнів відокремлює доброякісну оборонну роботу від справді небезпечних можливостей. В оцінці CyScenarioBench щодо Claude Opus 5.5 компанія повідомила, що заходи безпеки заблокували 46 із 50 завдань на рівні доступу до захисту. На рівні Red Team Access на тій же моделі жодне із завдань не було заблоковано, і модель виконала 34 із 50 — той самий показник завершення, зафіксований, коли жодних заходів безпеки не було застосовано.

Навпаки, згідно з Anthropic, без доступу до CVP кожне завдання блокувалося за першим запитом.

«Ці оцінки дають нам впевненість у тому, що ми можемо безпечно зробити розширені кіберможливості доступними для більшої кількості захисників, розширюючи захисні зусилля, які ми розпочали з Project Glasswing», — йдеться в повідомленні компанії, про яке широко повідомляли The Hacker News, Reuters і SecurityWeek.

Дизайн відображає ставку на те, що більшість захисних робіт із безпеки — виправлення, аналіз журналів, сортування зловмисного програмного забезпечення — можуть виконуватися під суворими огорожами, тоді як для законного наступального тестування потрібен ширший коридор. Це також відображає те, як індустрія безпеки вже давно обробляє інструменти подвійного призначення: перевіряйте фахівця, а не лише інструмент.

Розширений слід Glasswing

Розширення програми тісно пов’язане з проектом Glasswing, ініціативою Anthropic щодо застосування своїх моделей для посилення критичного програмного забезпечення. Компанія заявила, що Glasswing виявила щонайменше 129 000 підтверджених уразливостей програмного забезпечення в період з квітня по липень 2026 року та ще 5 500 перевірених уразливостей у період з квітня по жовтень за допомогою сканування з відкритим кодом.

З перевірених уразливостей понад 33 000 наразі були оцінені як критичні або високі — цифра, яку Anthropic описує як значну занижену кількість, оскільки вона спирається на дані опитування лише підмножини партнерів Glasswing. За оцінками компанії, справжній вплив може бути щонайменше в п’ять разів вищим.

Виміряний погляд на виявлення вразливостей, кероване ШІ

Незалежний аналіз показує, що потік недоліків, знайдених ШІ, не перетворюється безпосередньо на відповідну хвилю використаних порушень. В аналізі, опублікованому наприкінці минулого місяця, дослідник VulnCheck Патрік Гарріті виявив, що лише 2 із 300 уразливостей, виявлених Anthropic або Project Glasswing — приблизно 0,67 відсотка — були використані в дикій природі.

Дві використані недоліки: CVE-2026-26980, уразливість SQL-ін’єкції в Ghost CMS, і CVE-2026-61500, помилка підробки сеансу в Rejetto HTTP File Server. Ці дані підтверджують нюанс, на якому наголошують дослідники безпеки: штучний інтелект знижує бар’єр для виявлення вразливостей, але більшість недоліків, які він виявляє, ніколи не були на радарах зловмисників.

Оголошення також з’явилося на тлі широких дебатів щодо роботи з безпеки, створеної ШІ. Дослідження 1Password і Veracode показали, що написані штучним інтелектом виправлення вразливостей можуть самі вводити нові недоліки, підкреслюючи, що автоматизація допомагає, але не замінює перевірку людиною.

Що це означає для індустрії безпеки

Для команд безпеки CVP знижує енергію активації для використання прикордонних моделей під час справжньої оборонної роботи. Спеціалісти з реагування на інциденти отримують санкціонований шлях до допомоги з аналізом зловмисного програмного забезпечення; тестувальники проникнення отримують кероване середовище для атак за допомогою ШІ; а невелика група організацій, які самі перевіряють системи безпеки ШІ, отримують найменш обмежений доступ.

Для Anthropic програма одночасно є стратегією безпеки та комерційною. Це конкретизує позицію компанії про те, що потужні кібер-можливості слід надавати свідомо перевіреним захисникам, а не повністю пригнічувати — на відміну від конкурентів, які зіткнулися з пильною увагою щодо моделей із слабшим кібер-контролем. Це також поглиблює відносини Anthropic з підприємствами, які, швидше за все, платять за доступ до передової моделі: урядами, операторами критичної інфраструктури та великими постачальниками засобів безпеки.

Компанія не оголосила про зміни цін, пов’язані з програмою, і заявки обробляються через існуючі перевірені канали доступу Anthropic. Враховуючи масштаби того, що Glasswing вже оприлюднило — і власне визнання компанії, що цифри, ймовірно, занижують реальність, індустрія безпеки спостерігатиме за тим, скільки з цих 129 000 знахідок буде виправлено, перш ніж зловмисники знайдуть їх першими.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →