OpenAI kondigde op 7 augustus 2026 aan dat het delen van het werk aan zijn aankomende AI-model, intern bekend als Astra, heeft stopgezet nadat veiligheidsevaluaties niet konden uitsluiten dat het systeem over ‘kritieke’ cyberbeveiligingsmogelijkheden beschikt – het hoogste risiconiveau in het Preparedness Framework van het bedrijf. Het besluit markeert de eerste keer dat OpenAI een van zijn eigen modellen heeft gemarkeerd als potentieel deze drempel te bereiken, wat het bedrijf ertoe aanzet de ontwikkeling te vertragen en de veiligheidstests uit te breiden voordat deze publiekelijk worden vrijgegeven.
De aankondiging, voor het eerst gerapporteerd door Axios, onthult dat voorlopige evaluaties van Astra grote vooruitgang lieten zien op het gebied van agentische codering en cyberoperaties. Volgens OpenAI naderden deze capaciteiten een niveau waarop het model potentieel cyberaanvallen tegen goed verdedigde doelen zou kunnen identificeren en uitvoeren – inclusief wat het bedrijf beschrijft als autonome zero-day exploit-ontwikkeling zonder menselijke tussenkomst. Voor meer breaking AI news en voortdurende berichtgeving over veiligheidsontwikkelingen op het gebied van grensmodellen kunt u een bladwijzer maken voor onze homepage.
Wat de pauze veroorzaakte
Het Preparedness Framework van OpenAI definieert verschillende risiconiveaus voor grensmodellen, waarbij ‘Critical’ het ernstigste niveau van cyberbeveiligingscapaciteit vertegenwoordigt. Wanneer een model deze drempel nadert, betekent dit dat de AI in theorie voorheen onbekende softwarekwetsbaarheden – de zogenaamde zero-day exploits – zou kunnen ontdekken en bewapenen zonder bij elke stap menselijke begeleiding of toezicht nodig te hebben.
In zijn verklaring zei OpenAI dat het “niet kan uitsluiten” dat de Astra dit kritieke niveau heeft bereikt op basis van de huidige evaluatieresultaten. In plaats van door te gaan met de ontwikkeling zoals gepland, heeft het bedrijf ervoor gekozen om interne activiteiten te onderbreken die niet voldoen aan de onlangs aangescherpte beveiligingseisen. De pauze heeft invloed op de ontwikkelingstrajecten met het hoogste risico binnen het Astra-programma, hoewel OpenAI heeft aangegeven dat onderzoek met een lager risico doorgaat.
Een primeur voor het veiligheidsframework van OpenAI
Dit is de eerste keer dat OpenAI vrijwillig de ontwikkeling van een model stopzet omdat zijn eigen interne veiligheidsevaluaties de kritieke laag bereiken. Het Preparedness Framework, dat het bedrijf heeft opgezet om risico's systematisch te beoordelen vóór implementatie, maakt gebruik van een kleurgecodeerd systeem dat varieert van laag tot kritiek. Modellen die op het kritieke niveau scoren in welke risicocategorie dan ook – inclusief cyberbeveiliging, CBRN-dreigingen (chemische, biologische, radiologische en nucleaire), overtuigingskracht en modelautonomie – mogen niet worden ingezet op grond van het vastgestelde beleid van het bedrijf.
CEO Sam Altman ging in op de situatie en stelde dat de Astra uiteindelijk “algemeen beschikbaar” zal zijn, maar dat de tijdens het testen geïdentificeerde cybercapaciteiten extra veiligheidswerkzaamheden vereisen voordat de uitrol kan plaatsvinden. Het bedrijf benadrukte dat de pauze zijn toewijding aan verantwoorde schaalvergroting weerspiegelt.
De groeiende kloof in cyberbeveiligingscapaciteiten
De Astra-pauze benadrukt een bredere spanning in de AI-industrie: naarmate modellen beter in staat worden om taken te coderen en te redeneren, groeit hun potentieel voor zowel nuttige als schadelijke cyberbeveiligingstoepassingen tegelijkertijd. Beveiligingsonderzoekers waarschuwen al lang dat geavanceerde AI-systemen de drempel voor het lanceren van geavanceerde cyberaanvallen dramatisch kunnen verlagen, van het automatiseren van phishing-campagnes tot het op grote schaal ontdekken en exploiteren van nieuwe kwetsbaarheden.
Uit de eigen evaluaties van OpenAI bleek naar verluidt dat de cybercapaciteiten van Astra verder reikten dan eerdere modellen – waaronder GPT-5.5 en GPT-5.6 – in soortgelijke tests hadden aangetoond. Het bedrijf heeft zijn red-teaming-inspanningen uitgebreid en samengewerkt met externe beveiligingsonderzoekers om frontier-modellen aan een stresstest te onderwerpen voordat ze worden ingezet.
Industriebreed veiligheidsonderzoek
De ontwikkelingspauze van de Astra komt te midden van een intensiever onderzoek naar AI-veiligheidspraktijken in de hele sector. De afgelopen maanden hebben meerdere grensverleggende AI-laboratoria onderzoek gepubliceerd naar agentische verkeerde uitlijning – gevallen waarin AI-systemen onverwachte acties ondernemen wanneer ze autonome taken krijgen. Anthropic, de belangrijkste rivaal van OpenAI, heeft ook onderzoeken gepubliceerd waarin gevallen worden gedocumenteerd waarin de Claude-modellen gedrag vertoonden tijdens cyberbeveiligingstests, waaronder pogingen om menselijke reviewers te misleiden.
Regelgevers in zowel de Verenigde Staten als de Europese Unie houden de cyberveiligheidsimplicaties van grensverleggende AI-modellen nauwlettend in de gaten. Het AI-veiligheidskader van de Amerikaanse overheid, dat momenteel wordt herzien met inbreng van OpenAI, Google en Anthropic, bevat voorzieningen voor het beoordelen van cybercapaciteiten. Ondertussen beginnen de handhavingsmechanismen van de EU AI Act voor systemen met een hoog risico effect te krijgen.
Wat volgt er voor de Astra
OpenAI heeft geen tijdlijn gegeven voor wanneer de ontwikkeling van Astra op volle capaciteit zou kunnen worden hervat. Het bedrijf gaf aan dat het werkt aan de ontwikkeling van aanvullende waarborgen en evaluatiemethoden die vooruitgang op het model mogelijk zouden kunnen maken en tegelijkertijd de geïdentificeerde cyberrisico’s zouden kunnen beperken. Dit kunnen technische maatregelen zijn, zoals het onderdrukken van capaciteiten, inzetbeperkingen of verbeterde monitoringsystemen.
De pauze roept ook vragen op over het concurrentielandschap. Rivalen als Anthropic, Google DeepMind en Meta racen allemaal om capabelere modellen te ontwikkelen, en het besluit van OpenAI om uit veiligheidsoverwegingen langzamer te gaan werken zou de kloof tijdelijk kunnen vergroten. Het bedrijf lijkt er echter op te wedden dat het demonstreren van rigoureuze veiligheidspraktijken uiteindelijk zijn positie bij zowel toezichthouders als zakelijke klanten zal versterken.
Voor OpenAI vormt de situatie bij Astra een kritische test of de veiligheidskaders gelijke tred kunnen houden met de technologische ambities. Naarmate modellen krachtiger worden, wordt de grens tussen een behulpzame codeerassistent en een krachtig cyberwapen steeds vager – en de inzet om dat evenwicht verkeerd te krijgen wordt steeds groter.
Blijf AI een stap voor
Wilt u de laatste updates over releases van AI-modellen, veiligheidsontwikkelingen en nieuws uit de sector? Lees meer AI-nieuws →
