Společnost Anthropic v úterý oznámila významné rozšíření svého úsilí o model přístupu zaměřeného na bezpečnost a restrukturalizovala svou iniciativu prověřovaného přístupu na formální program kybernetického ověřování (CVP) se třemi odlišnými úrovněmi pro profesionály v oblasti kybernetické bezpečnosti. Tento krok přichází poté, co společnost zveřejnila, že její iniciativa Project Glasswing od dubna odhalila nejméně 129 000 ověřených softwarových zranitelností.

Restrukturalizovaný program umožňuje prověřeným bezpečnostním týmům provozovat nejschopnější modely Anthropic – včetně Claude Opus 5.5, Claude Sonnet 5.5 a Claude Mythos 5.1 – s omezeným zabezpečením a blokovacími klasifikátory, tedy oprávněními, která jsou běžně běžným uživatelům nedostupná. Podle Anthropic je cílem dát schopnosti hraniční umělé inteligence do rukou obránců dříve, než zlomyslní aktéři vyzbrojí stejné nástroje. For more context on this story, see our ongoing AI trends.

Tři úrovně přístupu, tři scénáře hrozeb

Nový program je uspořádán do tří úrovní přístupu, z nichž každá je přizpůsobena jinému typu bezpečnostní práce:

  • Defense Access pokrývá obranné operace, jako je reakce na incidenty, zpětné inženýrství malwaru a analýza a ověřování zranitelnosti.
  • Red Team Access přidává autorizované penetrační testování a red-teaming k případům defenzivního použití, což umožňuje simulované útoky proti systémům, které mají organizace oprávnění testovat.
  • Specializovaný přístup obsahuje nejméně bezpečnostních prvků a je vyhrazen pro omezený soubor ověřených organizací, které jsou oprávněny samy testovat bezpečnostní systémy AI.

Organizace a jednotlivé bezpečnostní týmy žádají o úroveň, která odpovídá jejich práci, a společnost Anthropic každou aplikaci před udělením přístupu zkontroluje. Společnost uvedla, že všechny tři úrovně zahrnují přístup k jejím současným vlajkovým modelům i k novým modelům, které budou vydány v budoucnu.

Zabezpečuje stále kousnutí — selektivně

Společnost Antropic spojila oznámení s hodnotícími daty, která měla ukázat, že systém úrovní odděluje benigní defenzivní práci od skutečně nebezpečných schopností. V hodnocení CyScenarioBench na Claude Opus 5.5 společnost oznámila, že zabezpečení zablokovalo 46 z 50 úkolů na úrovni Defence Access. V úrovni přístupu Red Team Access na stejném modelu nebyl žádný z úkolů zablokován a model dokončil 34 z 50 – stejná míra dokončení, jaká byla zaznamenána, když nebyla použita vůbec žádná ochranná opatření.

Naproti tomu bez přístupu k CVP byl každý úkol zablokován na první výzvu, podle Anthropic.

"Tato hodnocení nám dávají jistotu, že můžeme pokročilé kybernetické schopnosti bezpečně zpřístupnit širší skupině obránců, čímž rozšíříme obranné úsilí, které jsme začali s Project Glasswing," uvedla společnost ve svém oznámení, o kterém široce informovaly The Hacker News, Reuters a SecurityWeek.

Design odráží sázku, že většina defenzivních bezpečnostních prací – záplatování, analýza protokolů, třídění malwaru – může probíhat pod přísnými mantinely, zatímco legitimní útočné testování vyžaduje širší koridor. Odráží také to, jak bezpečnostní průmysl již dlouho zachází s nástroji dvojího použití: prověřujte odborníka, nikoli pouze nástroj.

Glasswingova rozšiřující se stopa

Rozšíření programu je úzce spjato s Project Glasswing, iniciativou společnosti Anthropic aplikovat své modely na zpevnění kritického softwaru. Společnost uvedla, že Glasswing odhalila nejméně 129 000 ověřených softwarových zranitelností mezi dubnem a červencem 2026 a dalších 5 500 ověřených zranitelností mezi dubnem a říjnem prostřednictvím skenování s otevřeným zdrojovým kódem.

Z ověřených zranitelností bylo více než 33 000 dosud hodnoceno jako kritické nebo vysoce závažné – toto číslo popisuje společnost Anthropic jako pravděpodobně významné podhodnocení, protože čerpá z údajů průzkumu pouze od podskupiny partnerů Glasswing. Společnost odhaduje, že skutečný dopad by mohl být nejméně pětkrát vyšší.

Měřený pohled na zjišťování zranitelnosti řízené umělou inteligencí

Nezávislá analýza naznačuje, že záplava nedostatků nalezených v AI se přímo nepromítá do odpovídající vlny zneužitých porušení. V analýze zveřejněné koncem minulého měsíce výzkumník VulnCheck Patrick Garrity zjistil, že pouze 2 z 300 zranitelností objevených Anthropic nebo Project Glasswing – zhruba 0,67 procenta – byly využity ve volné přírodě.

Dvěma zneužitými chybami jsou CVE-2026-26980, zranitelnost SQL injection v Ghost CMS, a CVE-2026-61500, chyba padělání relace v Rejetto HTTP File Server. Data podporují nuanci, na kterou bezpečnostní výzkumníci zdůrazňovali: AI snižuje bariéru pro objevování zranitelnosti, ale většina nedostatků, které uvádí, nikdy nebyla na radarech útočníků.

Oznámení také zapadá do širší debaty o bezpečnostní práci generované AI. Výzkum společností 1Password a Veracode ukázal, že záplaty zranitelnosti napsané umělou inteligencí mohou samy o sobě přinést nové nedostatky, což podtrhuje, že automatizace pomáhá, ale nenahrazuje ověřování člověkem.

Co to znamená pro bezpečnostní průmysl

Bezpečnostním týmům CVP snižuje aktivační energii pro použití hraničních modelů při skutečné obranné práci. Respondenti incidentů získají schválenou cestu k pomoci s analýzou malwaru; penetrační testeři získají řízené prostředí pro útoky podporované umělou inteligencí; a malá skupina organizací provádějících audit samotných bezpečnostních systémů AI má nejméně omezený přístup.

Pro společnost Anthropic je program bezpečnostní i komerční strategií. Konkretizuje pozici společnosti, že výkonné kybernetické schopnosti by měly být záměrně uvolněny prověřeným obráncům, spíše než úplně potlačeny – v kontrastu s konkurenty, kteří čelili kontrole nad modely se slabší kybernetickou kontrolou. Rovněž prohlubuje vztahy společnosti Anthropic s podniky, které budou pravděpodobně platit za hraniční model přístupu: vládami, provozovateli kritické infrastruktury a velkými dodavateli zabezpečení.

Společnost neoznámila změny cen související s programem a žádosti jsou zpracovávány prostřednictvím stávajících kanálů pro prověřený přístup společnosti Anthropic. Vzhledem k rozsahu toho, co Glasswing již vyšlo na povrch – a k vlastnímu přiznání společnosti, že čísla pravděpodobně podceňují realitu – bude bezpečnostní průmysl sledovat, kolik z těchto 129 000 nálezů bude opraveno, než je útočníci najdou jako první.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →