Anthropic heeft OSS Scanner gelanceerd, een gratis opt-in-service die gebruikmaakt van de sterkste AI-modellen van het bedrijf – waaronder Claude Mythos – om in aanmerking komende open-sourceprojecten periodiek te scannen op beveiligingskwetsbaarheden en om volledig door modellen gegenereerde bugrapporten rechtstreeks aan beheerders te leveren.

De dienst, woensdag aangekondigd in een blogpost van het bedrijf, is het product van een stille verschuiving in het beveiligingswerk van Anthropic: de modellen hebben de laatste tijd sneller kwetsbaarheden gevonden dan het eigen beveiligingsteam van Anthropic ze kan verifiëren. Voor ontwikkelaars die de tools volgen die de softwarebeveiliging hervormen, is de lancering een belangrijk moment voor onze berichtgeving over AI-ontwikkelingen in de open-sourceinfrastructuur.

Van Project Glasswing naar een openbare dienst

OSS Scanner is gebaseerd op de ervaring van Anthropic met het gebruik van Claude om kwetsbaarheden op te sporen tijdens Project Glasswing, de interne inspanning van het bedrijf om kwetsbaarheden te ontdekken. De cijfers uit dat werk verklaren waarom Anthropic de pijpleiding openstelt voor het publiek.

De afgelopen zes maanden zegt Anthropic dat zijn nieuwste modellen meer dan 29.000 potentiële kwetsbaarheden aan het licht hebben gebracht in enkele van 's werelds belangrijkste softwareprojecten, maar het bedrijf heeft er slechts ongeveer 6.000 handmatig kunnen beoordelen en beoordelen. Menselijke validatiecapaciteit, en niet modelcapaciteit, is het knelpunt geworden.

De vraagzijde vertelt een soortgelijk verhaal. Antropische berichten dat beheerders die de eerste rapporten ontvangen steeds vaker vragen om alles wat het bedrijf heeft: bijna 5.000 rapporten zijn al rechtstreeks verzonden naar beheerders die om bulkinzendingen van niet-geverifieerde bevindingen vroegen, inclusief patches.

De mogelijkhedencontext is grimmig. Op CyberGym, een academische benchmark voor het opsporen van kwetsbaarheden, zijn grote taalmodellen van het vinden van minder dan 20 procent van de kwetsbaarheden begin vorig jaar naar meer dan 85 procent dit jaar gegaan, volgens Anthropic – een sprong die AI-bugrapporten van ruis heeft omgezet in bruikbare bevindingen.

Hoe de cijfers stand hielden tijdens het testen

Vóór de lancering valideerde Anthropic de pijplijn met tientallen open-sourceprojecten, waarbij honderden bugrapporten werden geproduceerd – inclusief kwetsbaarheden die volgens het bedrijf konden worden gekoppeld aan niet-geverifieerde exploits van externe code-uitvoering.

De meest veelzeggende test was een onderzoek van buitenaf. Anthropic vroeg de deskundige penetratietesters die de bevindingen van de gecoördineerde kwetsbaarheidsonthulling (CVD) beoordelen, om 97 kritische en zeer ernstige bevindingen van de scanner te onderzoeken, afkomstig uit 48 projecten. Daarvan voldeed 85 – 88 procent – ​​aan de lat voor het CVD-proces van Anthropic. Van de overige twaalf waren er elf echt, maar dubbele bekende problemen of andere bevindingen uit dezelfde scan. Slechts één ervan was een regelrecht vals-positief resultaat.

Elk rapport, zegt het bedrijf, bevat een op zichzelf staande reproducer en een uitleg van de kwetsbaarheid, inclusief een tweedeling om te bepalen wanneer de fout werd geïntroduceerd.

De afweging: snelheid boven zekerheid

De centrale ontwerpbeslissing van OSS Scanner is ook het grootste risico: de rapporten zijn volledig op modellen gebaseerd, zonder menselijke beoordeling of triage. Anthropic maakt duidelijk dat dit sneller en frequenter scannen mogelijk maakt, maar ook dat sommige rapporten onjuist of ongeldig zullen zijn.

Het bedrijf beschouwt de afweging als reactie op de vraag van onderhouders. Omdat exploits nu binnen enkele minuten kunnen worden ontwikkeld, geven projecten er steeds meer de voorkeur aan om elke niet-geverifieerde vondst onmiddellijk te ontvangen – met de voorgestelde patches eraan – boven het wachten op menselijke controle. Geïnspireerd door Google's OSS-Fuzz, dat al jaren open source software met fuzzers scant, past OSS Scanner dezelfde logica toe op AI-gestuurde codeanalyse.

Projecten die de voorkeur geven aan traditionele afhandeling worden niet buiten beschouwing gelaten: Anthropic zegt dat het door zal gaan met het handmatig openbaar maken van door mensen geverifieerde kwetsbaarheidsrapporten via het bestaande CVD-proces, vooral voor projecten die niet over de middelen beschikken om de rapporten zelf te beoordelen. Er is een optionele fast-track beschikbaar voor degenen die ruwe bevindingen willen zodra ze zijn gegenereerd.

Wie kan zich inschrijven – en wat Anthropic nog meer heeft aangekondigd

Kernbeheerders van in aanmerking komende projecten kunnen zich inschrijven door een pull-verzoek in te dienen bij een GitHub-repository volgens een standaard projectsjabloon. Geschiktheid weerspiegelt de OSS-Fuzz-criteria: projecten moeten een kritische impact hebben op de infrastructuur en de gebruikersveiligheid, waarbij de toelating van geval tot geval wordt bepaald.

De scanner komt samen met een bredere reeks antropische beveiligingsinitiatieven. Het Cyber ​​Verification Program van het bedrijf maakt geavanceerde cybermogelijkheden en verminderde blokkeringsclassificatoren beschikbaar voor gekwalificeerde beveiligingsprofessionals – een programma dat Anthropic eerder deze week heeft uitgebreid met drie niveaus van Claude-toegang voor beveiligingsteams. Een afzonderlijke inspanning van Claude voor OSS biedt gratis Claude Max 20x-abonnementen om beheerders te helpen kwetsbaarheden te verhelpen en hun projecten te verbeteren. SiliconANGLE rapporteerde ook een nieuw Anthropic-programma gericht op het beschermen van kritieke infrastructuur, waarbij de aankondigingen van de week werden geformuleerd als een gecoördineerde stap in de richting van defensieve cyberbeveiliging.

Wat het betekent voor open source-beveiliging

Als OSS Scanner werkt zoals geadverteerd, markeert dit een structurele verschuiving in de open-sourcebeveiliging: AI vindt de bugs en mensen gaan over van jagen naar verifiëren. Deze verschuiving legt een echte last op de schouders van de beheerders, die door machines gegenereerde rapporten moeten beoordelen (waarvan sommige foutief zijn) terwijl ze moeten beslissen of ze geautomatiseerde patches moeten vertrouwen.

Het validatiepercentage van 88 procent suggereert dat de signaal-ruisverhouding nu goed genoeg is om de tijd van een onderhouder waard te zijn, tenminste voor kritieke infrastructuurprojecten. Of het bredere ecosysteem het daarmee eens is, zal blijken uit de inschrijvingsaantallen – en uit het aantal ingeschreven projecten dat zich stilletjes terugtrekt na de eerste stroom aan rapporten.

---

Blijf AI een stap voor

Ontvang het laatste AI-nieuws, analyses en doorbraken – allemaal op één plek.

Lees meer AI-nieuws →