Anthropic heeft dinsdag een grote uitbreiding aangekondigd van zijn op beveiliging gerichte inspanningen voor modeltoegang, waarbij het zijn initiatief voor doorgelichte toegang heeft geherstructureerd tot een formeel Cyber ​​Verification Program (CVP) met drie verschillende niveaus voor cyberbeveiligingsprofessionals. De stap komt nadat het bedrijf bekendmaakte dat zijn Project Glasswing-initiatief sinds april minstens 129.000 geverifieerde softwarekwetsbaarheden heeft ontdekt.

Het geherstructureerde programma stelt doorgelichte beveiligingsteams in staat om de meest capabele modellen van Anthropic te gebruiken – waaronder Claude Opus 5.5, Claude Sonnet 5.5 en Claude Mythos 5.1 – met verminderde beveiliging en blokkerende classificaties, machtigingen die normaal gesproken niet beschikbaar zijn voor algemene gebruikers. Volgens Anthropic is het doel om grensverleggende AI-capaciteiten in handen van verdedigers te geven voordat kwaadwillende actoren dezelfde tools als wapen gebruiken. Voor meer context over dit verhaal, zie ons AI-nieuws.

Drie toegangsniveaus, drie bedreigingsscenario's

Het nieuwe programma is georganiseerd rond drie toegangsniveaus, elk afgestemd op een ander type beveiligingswerk:

  • Defensietoegang omvat defensieve operaties zoals incidentrespons, reverse engineering van malware en analyse en validatie van kwetsbaarheden.
  • Red Team Access voegt geautoriseerde penetratietests en red-teaming toe aan de defensieve gebruiksscenario's, waardoor gesimuleerde aanvallen op systemen mogelijk zijn waarvoor organisaties toestemming hebben om te testen.
  • Gespecialiseerde toegang kent de minste waarborgen en is gereserveerd voor een beperkt aantal geverifieerde organisaties die bevoegd zijn om AI-veiligheidssystemen zelf te testen.

Organisaties en individuele beveiligingsteams vragen het niveau aan dat past bij hun werk, en Anthropic beoordeelt elke aanvraag voordat zij toegang verleent. Het bedrijf zei dat alle drie de niveaus toegang bieden tot de huidige vlaggenschipmodellen en tot nieuwe modellen die in de toekomst worden uitgebracht.

Waarborgen bijten nog steeds – selectief

Anthropic combineerde de aankondiging met evaluatiegegevens die bedoeld waren om aan te tonen dat het niveausysteem goedaardig defensief werk scheidt van echt gevaarlijk vermogen. In een CyScenarioBench-evaluatie van Claude Opus 5.5 meldde het bedrijf dat beveiliging 46 van de 50 taken in de Defense Access-laag blokkeerde. In de Red Team Access-laag op hetzelfde model werd geen van de taken geblokkeerd en voltooide het model 34 van de 50 – hetzelfde voltooiingspercentage als er helemaal geen waarborgen waren toegepast.

Zonder CVP-toegang werd daarentegen elke taak bij de eerste prompt geblokkeerd, aldus Anthropic.

“Deze evaluaties geven ons het vertrouwen dat we geavanceerde cybercapaciteiten veilig beschikbaar kunnen maken voor een bredere groep verdedigers, waardoor de defensieve inspanningen die we zijn begonnen met Project Glasswing worden uitgebreid”, aldus het bedrijf in zijn aankondiging, die breed werd uitgemeten door The Hacker News, Reuters en SecurityWeek.

Het ontwerp weerspiegelt de weddenschap dat het meeste defensieve beveiligingswerk – patchen, loganalyse, malware-triage – onder strikte vangrails kan plaatsvinden, terwijl legitieme offensieve tests een bredere corridor nodig hebben. Het weerspiegelt ook de manier waarop de beveiligingsindustrie al lang omgaat met tools voor tweeërlei gebruik: onderzoek de beoefenaar, niet alleen de tool.

De groeiende voetafdruk van Glasswing

De programma-uitbreiding is nauw gekoppeld aan Project Glasswing, het initiatief van Anthropic om zijn modellen toe te passen op het verharden van kritieke software. Het bedrijf zei dat Glasswing tussen april en juli 2026 minstens 129.000 geverifieerde softwarekwetsbaarheden heeft ontdekt, en tussen april en oktober nog eens 5.500 geverifieerde kwetsbaarheden door middel van open-source scaninspanningen.

Van de geverifieerde kwetsbaarheden zijn er tot nu toe ruim 33.000 als kritiek of zeer ernstig beoordeeld – een cijfer dat Anthropic beschrijft als waarschijnlijk een aanzienlijk onderaantal, omdat het zich baseert op enquêtegegevens van slechts een subset van Glasswing-partners. Het bedrijf schat dat de werkelijke impact minstens vijf keer zo groot kan zijn.

Een afgemeten kijk op AI-gestuurde ontdekking van kwetsbaarheden

Onafhankelijke analyse suggereert dat de stroom aan door AI gevonden tekortkomingen zich niet direct vertaalt in een bijpassende golf van misbruikte inbreuken. In een analyse die eind vorige maand werd gepubliceerd, ontdekte VulnCheck-onderzoeker Patrick Garrity dat slechts 2 van de 300 kwetsbaarheden ontdekt door Anthropic of Project Glasswing – ongeveer 0,67 procent – ​​in het wild zijn uitgebuit.

De twee misbruikte fouten zijn CVE-2026-26980, een kwetsbaarheid voor SQL-injectie in Ghost CMS, en CVE-2026-61500, een fout voor sessievervalsing in Rejetto HTTP File Server. De gegevens ondersteunen een nuance die beveiligingsonderzoekers hebben benadrukt: AI verlaagt de barrière voor het ontdekken van kwetsbaarheden, maar de meeste tekortkomingen die het aan het licht brengt, waren nooit op de radar van aanvallers.

De aankondiging komt ook terecht in een breder debat over door AI gegenereerd veiligheidswerk. Onderzoek van 1Password en Veracode heeft aangetoond dat door AI geschreven kwetsbaarheidspatches zelf nieuwe fouten kunnen introduceren, wat onderstreept dat automatisering menselijke verificatie helpt, maar niet vervangt.

Wat het betekent voor de beveiligingsindustrie

Voor beveiligingsteams verlaagt de CVP de activeringsenergie voor het gebruik van grensmodellen voor echt defensief werk. Incidentresponders krijgen een gesanctioneerd pad naar hulp bij malwareanalyse; penetratietesters krijgen een beheerde omgeving voor AI-ondersteunde aanvallen; en de kleine groep organisaties die AI-veiligheidssystemen zelf controleren, krijgen de minst beperkte toegang.

Voor Anthropic is het programma zowel een veiligheidsstrategie als een commerciële strategie. Het concretiseert het standpunt van het bedrijf dat krachtige cybercapaciteiten doelbewust moeten worden vrijgegeven aan doorgelichte verdedigers, in plaats van volledig te worden onderdrukt – een contrast met rivalen die te maken hebben gehad met kritisch onderzoek naar modellen met zwakkere cybercontroles. Het verdiept ook de relaties van Anthropic met de ondernemingen die het meest waarschijnlijk zullen betalen voor toegang tot grensmodellen: overheden, exploitanten van kritieke infrastructuur en grote beveiligingsleveranciers.

Het bedrijf heeft geen prijswijzigingen aangekondigd die verband houden met het programma, en aanvragen worden verwerkt via de bestaande kanalen met gecontroleerde toegang van Anthropic. Gezien de omvang van wat Glasswing al aan het licht heeft gebracht – en de eigen erkenning van het bedrijf dat de cijfers waarschijnlijk de werkelijkheid onderschatten – zal de beveiligingsindustrie in de gaten houden hoeveel van die 129.000 bevindingen worden opgelost voordat aanvallers ze als eerste vinden.

---

Blijf Voorop met AI

Het laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.

Lees meer AI-nieuws →