OpenAI pratar med flera oberoende bedömare för att hjälpa till att öka antalet företag som har expertis inom gränsöverskridande AI-säkerhet och kan tillhandahålla effektiva tredjepartsbedömningar, sade företaget i ett blogginlägg publicerat tisdagen den 22 september, som rapporterats av PYMNTS.
Inlägget beskriver OpenAI:s föreslagna prioriteringar och principer för effektiv tillsyn från tredje part - ett ramverk som det säger bör gälla för alla frontier AI-labb när de tränar, utvärderar och distribuerar alltmer kapabla modeller. Tillkännagivandet landar mitt i en ovanligt laddad månad för AI-säkerhetspolicy, och det läses som både en eftergift till kritiker och ett försök att forma reglerna innan regeringar skriver dem. För alla som följer brytande AI-nyheter, är det det senaste draget i en veckor lång tävling mellan laboratorierna, deras kritiker och tillsynsmyndigheter om vem som får verifiera att frontier-modeller är säkra.
Vad OpenAI föreslår
"Vi är fast beslutna att stödja oberoende bedömare och upprätta tydligare, delade internationella standarder - både genom framtida lagar och privata förvaltningsinitiativ - för effektiva tredjepartsbedömningar", sa OpenAI i inlägget, enligt PYMNTS.
Det kärnproblem som OpenAI beskriver är ett marknadsmisslyckande: det finns helt enkelt för få organisationer med tekniskt djup för att granska en frontiermodell. En meningsfull säkerhetsbedömning kräver tillgång till outgivna system, expertis inom områden från cybersäkerhet till biosäkerhet och institutionellt oberoende för att publicera ovälkomna resultat. Genom att rekrytera och stödja flera bedömare snarare än en enda privilegierad revisor, säger OpenAI att de vill bygga ett ekosystem där utvärdering av tredje part är en rutinmässig del av utbyggnaden av gränssystem – inte en engångsföreteelse för PR.
Företaget namngav inte de bedömare som det pratar med, och det återstår att se om de resulterande arrangemangen kommer att ge utvärderarna den tillgång, finansieringsoberoende och publiceringsrättigheter som säkerhetsforskare anser vara meningsfulla.
En vecka av whiplash om AI-policy
Förslaget kommer mitt i en snabb sekvens av policyutveckling som har definierat septembers AI-debatt:
- Måndag 21 september: OpenAI uppmanade USA att leda en internationell ansträngning för att utveckla globala tekniska standarder för frontier AI – inklusive rekursiv självförbättring, punkten då AI-system förbättrar sig själva. Företaget varnade för att helt autonom AI-utveckling kan överträffa människors förmåga att förstå och kontrollera den, och sa att beslut om huruvida och hur man ska gå vidare måste fattas nu.
- Fredag 18 september: Kaliforniens guvernör Gavin Newsom undertecknade en verkställande order som sammankallar nationella experter för att förstärka statens AI-säkerhetslagar, som uttryckligen syftar till att påskynda implementeringen av ny tredjepartstillsyn av säkerhets- och säkerhetsrisker i AI-system.
- Lördag 19 september: President Donald Trump avvisade branschens säkerhetsproblem i ett Truth Social-inlägg och skrev: "Vi kommer inte på något sätt att hindra eller kväva tillväxten av denna otroliga industri. AI är nästa industriella revolution, eller Internet, men kommer att bli ännu större och mer påverkande, möjligen så mycket som 25% av vårt lands BNP."
Som vi rapporterade tidigare i veckan, markerade OpenAIs USA-ledda standardförslag en slående förändring för ett företag som ägnat år åt att motstå bindande tillsyn – och de nya principerna för utvärdering av tredje part utvidgar den hållningen till den privata förvaltningsfronten.
Självständighetsproblemet
OpenAI:s omfamning av externa vakthundar följer ett parallellt förslag från dess främsta rival. Ungefär en vecka tidigare publicerade Anthropics vd Dario Amodei en uppsats som föreslog en AI-säkerhetsplan byggd kring oberoende utvärderare inbäddade i ledande AI-företag, samordning mellan företag i demokratiska länder och så småningom ett internationellt avtal som inkluderar Kina.
Båda förslagen har väckt omedelbar skepsis från experter. CNBC rapporterade att en koalition av mer än 100 AI-experter uppmanar till oberoende och transparens från Anthropic, OpenAI och andra stiftelsemodelllabb som genomför utvärderingar, och varnar för att utvärderare som är inbäddade i - eller betalda av - företagen de granskar möter oundvikliga intressekonflikter. Vakthundar med stöd av AI-pionjären Geoffrey Hinton har pressat båda företagen på detaljerna i deras säkerhetsplaner, och kommentatorer har flaggat för svängdörren mellan AI-säkerhetsutvärderingsorganisationer och laboratorierna själva: personerna som betygsätter säkerhetsläxan kan också vara de som skrev den.
Den spänningen är kärnan i debatten OpenAI:s nya inlägg försöker avskaffa. Företagets svar – fler bedömare, delade internationella standarder och tillsyn som upprätthålls genom både framtida lagar och privata initiativ – är ett ramverk, ännu inte en garanti. Kritiker kommer att påpeka att de labb som föreslår reglerna är samma labb som omfattas av dem, och att självformad styrning historiskt sett har gynnat företagen som gör formningen.
Varför det är viktigt
Nästa frontier-modeller är redan under utbildning, och fönstret för utformning av övervakning innan utplacering är nära. Om OpenAI:s rekrytering av oberoende bedömare producerar revisorer med verklig tillgång och verkligt oberoende, kan det bli mallen för hur frontier AI styrs över hela världen – en privat regim som lagstiftare i Washington, Bryssel och på andra håll hittills inte lyckats bygga upp själva. Om det producerar anslutna konsultföretag med NDA:er kommer det att bekräfta skeptikernas värsta läsning.
Hur som helst, det faktum att OpenAI konkurrerar med Anthropic om vem som kan föreslå den mest trovärdiga tillsynsregimen är i sig nytt. För ett år sedan var labben enade främst i att motsätta sig reglering. Nu tävlar de om att definiera det.
---
Ligg före AIFå de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.
Läs mer AI-nyheter →