OpenAI praat met meerdere onafhankelijke beoordelaars om het aantal bedrijven te helpen groeien dat expertise heeft op het gebied van grensverleggende AI-veiligheid en effectieve beoordelingen door derden kan bieden, aldus het bedrijf in een blogpost die dinsdag 22 september is gepubliceerd, zoals gerapporteerd door PYMNTS.
In de post worden de door OpenAI voorgestelde prioriteiten en principes uiteengezet voor effectief toezicht door derden – een raamwerk dat volgens het rapport van toepassing zou moeten zijn op alle grensverleggende AI-laboratoria terwijl ze steeds capabelere modellen trainen, evalueren en inzetten. De aankondiging komt midden in een ongewoon beladen maand voor het AI-veiligheidsbeleid, en het leest als zowel een concessie aan critici als een poging om de regels vorm te geven voordat regeringen ze schrijven. Voor iedereen die het laatste AI-nieuws (https://aibuzzwire.news) volgt, is dit de laatste stap in een wekenlange strijd tussen de laboratoria, hun critici en toezichthouders over wie mag verifiëren dat grensmodellen veilig zijn.
Wat OpenAI voorstelt
"We zijn toegewijd aan het ondersteunen van onafhankelijke beoordelaars en het vaststellen van duidelijkere, gedeelde internationale normen – zowel door toekomstige wetten als door initiatieven op het gebied van particulier bestuur – voor effectieve beoordelingen door derden", aldus OpenAI in de post, volgens PYMNTS.
Het kernprobleem dat OpenAI beschrijft is marktfalen: er zijn simpelweg te weinig organisaties met de technische diepgang om een grensmodel te auditeren. Een betekenisvolle veiligheidsbeoordeling vereist toegang tot nog niet vrijgegeven systemen, expertise op gebieden van cyberbeveiliging tot biobeveiliging, en de institutionele onafhankelijkheid om ongewenste bevindingen te publiceren. Door meerdere beoordelaars te werven en te ondersteunen in plaats van één enkele bevoorrechte auditor, zegt OpenAI een ecosysteem te willen opbouwen waarin evaluatie door derden een routinematig onderdeel is van de inzet van grensoverschrijdende systemen – en niet een eenmalige PR-oefening.
Het bedrijf heeft de beoordelaars waarmee het praat niet genoemd, en het valt nog te bezien of de daaruit voortvloeiende regelingen de beoordelaars de toegang, financieringsonafhankelijkheid en publicatierechten zullen geven die veiligheidsonderzoekers als zinvol beschouwen.
Een week van whiplash op het gebied van AI-beleid
Het voorstel komt te midden van een snelle opeenvolging van beleidsontwikkelingen die het AI-debat van september hebben bepaald:
- Maandag 21 september: OpenAI riep de Verenigde Staten op om leiding te geven aan een internationale inspanning om mondiale technische standaarden te ontwikkelen voor grensverleggende AI – inclusief recursieve zelfverbetering, het punt waarop AI-systemen zichzelf verbeteren. Het bedrijf waarschuwde dat de volledig autonome ontwikkeling van AI het vermogen van de mens om het te begrijpen en te controleren zou kunnen overtreffen, en zei dat beslissingen over de vraag of en hoe verder te gaan nu moeten worden genomen.
- Vrijdag 18 september: De gouverneur van Californië, Gavin Newsom, ondertekende een uitvoerend bevel waarbij nationale experts werden bijeengeroepen om de AI-veiligheidswetten van de staat te versterken, expliciet gericht op het versnellen van de implementatie van nieuw toezicht van derden op veiligheids- en beveiligingsrisico's in AI-systemen.
- Zaterdag 19 september: President Donald Trump verwierp de veiligheidsproblemen van de industrie in een Truth Social-post en schreef: "We zullen op geen enkele manier de groei van deze ongelooflijke industrie belemmeren of onderdrukken. AI is de volgende industriële revolutie, of internet, maar zal zelfs nog groter en impactvoller zijn, mogelijk wel 25% van het bbp van ons land."
Zoals we eerder deze week meldden, markeerde het door de VS geleide standaardvoorstel van OpenAI een opvallende verschuiving voor een bedrijf dat zich jarenlang heeft verzet tegen bindend toezicht – en de nieuwe beoordelingsprincipes van derden breiden die houding uit naar het front van het particuliere bestuur.
Het onafhankelijkheidsprobleem
OpenAI's omarming van externe waakhonden volgt op een parallel voorstel van zijn belangrijkste rivaal. Ongeveer een week eerder publiceerde Dario Amodei, CEO van Anthropic, een essay waarin hij een AI-veiligheidsplan voorstelde, opgebouwd rond onafhankelijke beoordelaars ingebed in toonaangevende AI-bedrijven, coördinatie tussen bedrijven in democratische landen, en uiteindelijk een internationale overeenkomst waar ook China deel van uitmaakt.
Both proposals have drawn immediate skepticism from experts. CNBC reported that a coalition of more than 100 AI experts is urging independence and transparency from Anthropic, OpenAI and other foundation model labs conducting evaluations, warning that evaluators who are embedded within — or paid by — the companies they audit face unavoidable conflicts of interest. Watchdogs backed by AI pioneer Geoffrey Hinton have pressed both companies on the details of their safety plans, and commentators have flagged the revolving door between AI safety evaluation organizations and the labs themselves: the people grading the safety homework may also be the ones who wrote it.
That tension is the crux of the debate OpenAI's new post tries to defuse. The company's answer — more assessors, shared international standards, and oversight enforced through both future laws and private initiatives — is a framework, not yet a guarantee. Critics will point out that the labs proposing the rules are the same labs subject to them, and that self-shaped governance has historically favored the companies doing the shaping.
Why It Matters
The next frontier models are already in training, and the window for designing oversight before deployment is closing. If OpenAI's recruitment of independent assessors produces auditors with real access and real independence, it could become the template for how frontier AI is governed worldwide — a private regime that lawmakers in Washington, Brussels and elsewhere have so far failed to build themselves. If it produces affiliated consultancies with NDAs, it will confirm the skeptics' worst reading.
Either way, the fact that OpenAI is competing with Anthropic over who can propose the most credible oversight regime is itself new. A year ago, the labs were unified mainly in opposing regulation. Now they are racing to define it.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →