Anthropic ogłosiła we wtorek znaczne rozszerzenie swoich wysiłków w zakresie dostępu do modeli skoncentrowanych na bezpieczeństwie, przekształcając swoją inicjatywę dotyczącą sprawdzonego dostępu w formalny program weryfikacji cybernetycznej (CVP) z trzema odrębnymi poziomami dla specjalistów ds. cyberbezpieczeństwa. Decyzja ta nastąpiła po ujawnieniu przez firmę informacji, że od kwietnia w ramach inicjatywy Project Glasswing wykryto co najmniej 129 000 zweryfikowanych luk w oprogramowaniu.

Zrestrukturyzowany program umożliwia sprawdzonym zespołom ds. bezpieczeństwa uruchamianie najpotężniejszych modeli Anthropic — w tym Claude Opus 5.5, Claude Sonnet 5.5 i Claude Mythos 5.1 — przy ograniczonych zabezpieczeniach i klasyfikatorach blokujących, czyli uprawnieniach, które zwykle są niedostępne dla zwykłych użytkowników. Według Anthropic celem jest oddanie pionierskich możliwości sztucznej inteligencji w ręce obrońców, zanim złośliwe podmioty użyją tych samych narzędzi jako broni. Więcej kontekstu na ten temat znajdziesz w naszych wiadomości AI.

Trzy poziomy dostępu, trzy scenariusze zagrożeń

Nowy program jest zorganizowany wokół trzech poziomów dostępu, każdy dostosowany do innego rodzaju pracy związanej z bezpieczeństwem:

  • Defense Access obejmuje operacje obronne, takie jak reagowanie na incydenty, inżynieria wsteczna złośliwego oprogramowania oraz analiza i weryfikacja podatności.
  • Red Team Access dodaje autoryzowane testy penetracyjne i red-team do przypadków użycia defensywnego, umożliwiając symulowane ataki na systemy, do testowania których organizacje mają pozwolenie.
  • Dostęp specjalistyczny zapewnia najmniejszą liczbę zabezpieczeń i jest zarezerwowany dla ograniczonej grupy zweryfikowanych organizacji, które są upoważnione do samodzielnego testowania systemów bezpieczeństwa AI.

Organizacje i poszczególne zespoły ds. bezpieczeństwa ubiegają się o warstwę odpowiadającą ich pracy, a Anthropic sprawdza każdą aplikację przed przyznaniem dostępu. Firma podała, że ​​wszystkie trzy poziomy obejmują dostęp do obecnych flagowych modeli, a także nowych modeli wprowadzanych na rynek w przyszłości.

Chroni przed ugryzieniem — selektywnie

Anthropic powiązał to ogłoszenie z danymi oceniającymi, które miały pokazać, że system poziomów oddziela łagodną pracę obronną od naprawdę niebezpiecznych zdolności. W ocenie CyScenarioBench dotyczącej Claude Opus 5.5 firma poinformowała, że ​​zabezpieczenia zablokowały 46 z 50 zadań na poziomie Defense Access. Na poziomie Red Team Access w tym samym modelu żadne z zadań nie zostało zablokowane, a model wykonał 34 z 50 — taki sam wskaźnik ukończenia odnotowano, gdy w ogóle nie zastosowano żadnych zabezpieczeń.

Według Anthropic, bez dostępu CVP, każde zadanie zostało zablokowane po pierwszym komunikacie.

„Te oceny dają nam pewność, że możemy bezpiecznie udostępnić zaawansowane możliwości cybernetyczne szerszemu gronu obrońców, rozszerzając wysiłki obronne, które rozpoczęliśmy w ramach Projektu Glasswing” – stwierdziła firma w swoim oświadczeniu, które szeroko relacjonowały dzienniki The Hacker News, Reuters i SecurityWeek.

Projekt odzwierciedla założenie, że większość prac związanych z bezpieczeństwem defensywnym — łatanie, analiza logów, selekcja złośliwego oprogramowania — może przebiegać pod ścisłymi barierami, podczas gdy legalne testy ofensywne wymagają szerszego korytarza. Odzwierciedla to również sposób, w jaki branża zabezpieczeń od dawna radzi sobie z narzędziami podwójnego zastosowania: sprawdzaj praktyka, a nie tylko narzędzie.

Rozszerzający się ślad Szklanego Skrzydła

Rozszerzenie programu jest ściśle powiązane z Projektem Glasswing – inicjatywą firmy Anthropic mającą na celu zastosowanie jej modeli do wzmacniania krytycznego oprogramowania. Firma podała, że ​​Glasswing odkrył co najmniej 129 000 zweryfikowanych luk w oprogramowaniu między kwietniem a lipcem 2026 r. oraz dodatkowe 5500 zweryfikowanych luk w zabezpieczeniach w okresie od kwietnia do października w wyniku skanowania open source.

Spośród zweryfikowanych luk ponad 33 000 zostało jak dotąd ocenionych jako krytyczne lub o wysokiej wadze — liczba ta została uznana przez Anthropic za prawdopodobnie znaczne zaniżenie, ponieważ opiera się na danych z ankiet przeprowadzonych jedynie przez podzbiór partnerów Glasswing. Firma szacuje, że rzeczywisty wpływ może być co najmniej pięciokrotnie większy.

Zmierzony pogląd na wykrywanie luk w zabezpieczeniach za pomocą sztucznej inteligencji

Niezależna analiza sugeruje, że zalew luk wykrytych przez sztuczną inteligencję nie przekłada się bezpośrednio na odpowiednią falę wykorzystywanych naruszeń. W analizie opublikowanej pod koniec ubiegłego miesiąca badacz VulnCheck, Patrick Garrity, odkrył, że tylko 2 z 300 luk wykrytych przez Anthropic lub Project Glasswing — około 0,67 procent — zostało wykorzystanych w środowisku naturalnym.

Dwie wykorzystywane luki to CVE-2026-26980, luka umożliwiająca wstrzyknięcie SQL w Ghost CMS, oraz CVE-2026-61500, luka polegająca na fałszowaniu sesji w Rejetto HTTP File Server. Dane potwierdzają niuans, który podkreślają badacze bezpieczeństwa: sztuczna inteligencja obniża barierę uniemożliwiającą wykrycie luk w zabezpieczeniach, ale większość wykrytych przez nią luk nigdy nie była widoczna na radarach atakujących.

Oświadczenie pojawia się również w kontekście szerszej debaty na temat działań związanych z bezpieczeństwem generowanych przez sztuczną inteligencję. Badania przeprowadzone przez 1Password i Veracode wykazały, że poprawki luk w zabezpieczeniach napisane przez sztuczną inteligencję mogą same wprowadzać nowe wady, co podkreśla, że ​​automatyzacja pomaga, ale nie zastępuje weryfikacji przez człowieka.

Co to oznacza dla branży zabezpieczeń

W przypadku zespołów bezpieczeństwa CVP obniża energię aktywacji w celu wykorzystania modeli granicznych w prawdziwej pracy obronnej. Osoby reagujące na incydenty zyskują usankcjonowaną ścieżkę pomocy w analizie złośliwego oprogramowania; testerzy penetracji otrzymują zarządzane środowisko dla ataków wspomaganych przez sztuczną inteligencję; a niewielki zbiór organizacji audytujących same systemy bezpieczeństwa AI ma najmniej ograniczony dostęp.

Dla Anthropic program jest zarówno strategią bezpieczeństwa, jak i komercyjną. Konkretyzuje stanowisko firmy, że potężne możliwości cybernetyczne powinny być celowo udostępniane sprawdzonym obrońcom, a nie całkowicie tłumione – co kontrastuje z rywalami, którzy zostali poddani analizie modeli ze słabszą kontrolą cybernetyczną. Pogłębia także relacje firmy Anthropic z przedsiębiorstwami, które najprawdopodobniej płacą za dostęp do modeli granicznych: rządami, operatorami infrastruktury krytycznej i dużymi dostawcami zabezpieczeń.

Firma nie ogłosiła zmian cen związanych z programem, a wnioski są przetwarzane za pośrednictwem istniejących, sprawdzonych kanałów dostępu Anthropic. Biorąc pod uwagę skalę tego, co ujawnił już Glasswing – oraz przyznanie przez firmę, że liczby te prawdopodobnie zaniżają rzeczywistość – branża bezpieczeństwa będzie obserwować, ile z tych 129 000 ustaleń zostanie naprawionych, zanim atakujący znajdą je pierwsi.

---

Bądź na Bieżąco z AI

Najnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.

Czytaj więcej wiadomości AI →