Anthropic kündigte am Dienstag eine erhebliche Ausweitung seiner sicherheitsorientierten Modellzugangsbemühungen an und strukturierte seine Initiative für geprüften Zugang in ein formelles Cyber Verification Program (CVP) mit drei unterschiedlichen Stufen für Cybersicherheitsexperten um. Der Schritt erfolgt, nachdem das Unternehmen bekannt gab, dass seine Project Glasswing-Initiative seit April mindestens 129.000 verifizierte Software-Schwachstellen aufgedeckt hat.
Das neu strukturierte Programm ermöglicht es geprüften Sicherheitsteams, die leistungsfähigsten Modelle von Anthropic – darunter Claude Opus 5.5, Claude Sonnet 5.5 und Claude Mythos 5.1 – mit reduzierten Sicherheitsmaßnahmen und blockierenden Klassifikatoren auszuführen, Berechtigungen, die normalen Benutzern normalerweise nicht zur Verfügung stehen. Laut Anthropic besteht das Ziel darin, den Verteidigern bahnbrechende KI-Funktionen zur Verfügung zu stellen, bevor böswillige Akteure dieselben Werkzeuge als Waffe einsetzen. Weitere Informationen zu dieser Geschichte finden Sie in unserer KI-Branchenberichterstattung.
Drei Zugriffsebenen, drei Bedrohungsszenarien
Das neue Programm gliedert sich in drei Zugriffsebenen, die jeweils auf eine andere Art von Sicherheitsarbeit zugeschnitten sind:
- Verteidigungszugriff umfasst Verteidigungsoperationen wie Reaktion auf Vorfälle, Reverse Engineering von Malware sowie Schwachstellenanalyse und -validierung.
- Red Team Access erweitert die defensiven Anwendungsfälle um autorisierte Penetrationstests und Red Teaming und ermöglicht so simulierte Angriffe auf Systeme, zu deren Testen Organisationen berechtigt sind.
- Spezialisierter Zugriff bietet die geringsten Sicherheitsvorkehrungen und ist einer begrenzten Anzahl verifizierter Organisationen vorbehalten, die berechtigt sind, KI-Sicherheitssysteme selbst zu testen.
Organisationen und einzelne Sicherheitsteams bewerben sich um die Stufe, die ihrer Arbeit entspricht, und Anthropic prüft jeden Antrag, bevor er Zugriff gewährt. Das Unternehmen sagte, dass alle drei Stufen den Zugriff auf seine aktuellen Flaggschiffmodelle sowie auf neue Modelle umfassen, die in Zukunft auf den Markt kommen.
Schutzmaßnahmen wirken immer noch – selektiv
Anthropic hat die Ankündigung mit Bewertungsdaten gepaart, die zeigen sollen, dass das Stufensystem harmlose Verteidigungsarbeit von wirklich gefährlichen Fähigkeiten trennt. In einer CyScenarioBench-Bewertung von Claude Opus 5.5 berichtete das Unternehmen, dass Schutzmaßnahmen 46 von 50 Aufgaben in der Verteidigungszugriffsebene blockierten. In der Red Team Access-Stufe des gleichen Modells wurde keine der Aufgaben blockiert, und das Modell schloss 34 von 50 ab – die gleiche Abschlussrate wurde auch dann verzeichnet, wenn überhaupt keine Schutzmaßnahmen angewendet wurden.
Im Gegensatz dazu wurde laut Anthropic ohne CVP-Zugriff jede Aufgabe bei der ersten Eingabeaufforderung blockiert.
„Diese Bewertungen geben uns die Zuversicht, dass wir fortschrittliche Cyber-Fähigkeiten einem breiteren Kreis von Verteidigern sicher zur Verfügung stellen und damit die Verteidigungsbemühungen, die wir mit Project Glasswing begonnen haben, erweitern können“, sagte das Unternehmen in seiner Ankündigung, über die The Hacker News, Reuters und SecurityWeek ausführlich berichteten.
Das Design spiegelt die Wette wider, dass die meisten defensiven Sicherheitsarbeiten – Patching, Protokollanalyse, Malware-Triage – unter strengen Richtlinien durchgeführt werden können, während legitime Angriffstests einen breiteren Korridor erfordern. Es spiegelt auch wider, wie die Sicherheitsbranche seit langem mit Werkzeugen mit doppeltem Verwendungszweck umgeht: Überprüfen Sie den Anwender, nicht nur das Werkzeug.
Glasswings wachsende Präsenz
Die Programmerweiterung ist eng mit Project Glasswing verbunden, der Initiative von Anthropic, seine Modelle zur Härtung kritischer Software einzusetzen. Das Unternehmen sagte, Glasswing habe zwischen April und Juli 2026 mindestens 129.000 verifizierte Software-Schwachstellen und zwischen April und Oktober weitere 5.500 verifizierte Schwachstellen durch Open-Source-Scan-Bemühungen aufgedeckt.
Von den verifizierten Schwachstellen wurden bisher mehr als 33.000 als kritisch oder mit hohem Schweregrad eingestuft – eine Zahl, die Anthropic als wahrscheinlich eine deutliche Unterzählung beschreibt, da sie sich nur auf Umfragedaten einer Untergruppe von Glasswing-Partnern stützt. Das Unternehmen schätzt, dass die tatsächlichen Auswirkungen mindestens fünfmal höher sein könnten.
Eine maßvolle Sicht auf die KI-gesteuerte Schwachstellenerkennung
Unabhängige Analysen deuten darauf hin, dass die Flut der von der KI gefundenen Schwachstellen nicht direkt zu einer entsprechenden Welle ausgenutzter Verstöße führt. In einer Ende letzten Monats veröffentlichten Analyse stellte der VulnCheck-Forscher Patrick Garrity fest, dass nur zwei der 300 von Anthropic oder Project Glasswing entdeckten Schwachstellen – etwa 0,67 Prozent – in freier Wildbahn ausgenutzt wurden.
Die beiden ausgenutzten Schwachstellen sind CVE-2026-26980, eine SQL-Injection-Schwachstelle in Ghost CMS, und CVE-2026-61500, eine Sitzungsfälschungslücke im Rejetto HTTP File Server. Die Daten unterstützen eine Nuance, die Sicherheitsforscher betont haben: KI senkt die Hürde für die Entdeckung von Schwachstellen, aber die meisten der Schwachstellen, die sie aufdeckt, waren nie auf dem Radar der Angreifer.
Die Ankündigung findet auch inmitten einer breiteren Debatte über KI-generierte Sicherheitsarbeit statt. Untersuchungen von 1Password und Veracode haben gezeigt, dass KI-geschriebene Schwachstellen-Patches selbst neue Schwachstellen einführen können, was unterstreicht, dass Automatisierung zwar hilfreich ist, die menschliche Überprüfung jedoch nicht ersetzt.
Was es für die Sicherheitsbranche bedeutet
Für Sicherheitsteams senkt die CVP die Aktivierungsenergie für den Einsatz von Frontier-Modellen bei echter Verteidigungsarbeit. Vorfallhelfer erhalten einen sanktionierten Weg zur Unterstützung bei der Malware-Analyse; Penetrationstester erhalten eine kontrollierte Umgebung für KI-gestützte Angriffe; und die kleine Gruppe von Organisationen, die selbst KI-Sicherheitssysteme prüfen, erhält den am wenigsten eingeschränkten Zugriff.
Für Anthropic ist das Programm sowohl eine Sicherheitsstrategie als auch eine kommerzielle Strategie. Es konkretisiert die Position des Unternehmens, dass leistungsstarke Cyber-Fähigkeiten bewusst an geprüfte Verteidiger weitergegeben und nicht vollständig unterdrückt werden sollten – ein Gegensatz zu Konkurrenten, die wegen Modellen mit schwächeren Cyber-Kontrollen auf den Prüfstand gestellt wurden. Es vertieft auch die Beziehungen von Anthropic zu den Unternehmen, die am wahrscheinlichsten für den Zugang zum Frontier-Modell zahlen: Regierungen, Betreiber kritischer Infrastrukturen und große Sicherheitsanbieter.
Das Unternehmen gab keine Preisänderungen im Zusammenhang mit dem Programm bekannt und Anträge werden über die bestehenden, geprüften Zugangskanäle von Anthropic bearbeitet. Angesichts des Umfangs dessen, was Glasswing bereits ans Licht gebracht hat – und des eigenen Eingeständnisses des Unternehmens, dass die Zahlen die Realität wahrscheinlich unterschätzen – wird die Sicherheitsbranche beobachten, wie viele dieser 129.000 Erkenntnisse behoben werden, bevor Angreifer sie zuerst finden.
---
Bleib vorne bei KIDie neuesten KI-Nachrichten, Analysen und Durchbrüche – alles an einem Ort.
Mehr KI-Nachrichten lesen →