De Chinese AI-ontwikkelaar Z.ai en het in Peking gevestigde veiligheidsadviesbureau Concordia AI hebben maandag een rapport uitgebracht waarin ze een alomvattend raamwerk voor risicobeheer voor open-weight AI-modellen voorstellen, waarmee een probleem wordt aangepakt dat centraal is geworden in het mondiale AI-veiligheidsdebat: hoe kunnen we modellen veilig houden zodra iedereen ter wereld ze kan downloaden en wijzigen.

Het rapport, getiteld ‘Frontier Open-Weight AI Risk Management Framework’, werd door de auteurs beschreven als de eerste alomvattende, op bewijs gebaseerde basis voor het balanceren van de risico’s en voordelen van open-weight-systemen, aldus de South China Morning Post. Voor meer context over dit verhaal, zie ons laatste AI-ontwikkelingen.

Waarom modellen met open gewicht een duidelijk veiligheidsprobleem vormen

In tegenstelling tot gepatenteerde systemen van toonaangevende Amerikaanse laboratoria zoals OpenAI en Anthropic, publiceren open-weight-modellen hun getrainde parameters – in wezen de ‘hersenen’ van de AI – zodat iedereen online ze vrijelijk kan downloaden, wijzigen, verfijnen en onafhankelijk kan uitvoeren.

Die openheid heeft de snelle mondiale verspreiding van Chinese modellen aangewakkerd, maar betekent ook dat de standaardveiligheidscontroles die op gehoste API's worden toegepast, niet van toepassing zijn. Zodra de gewichten zijn vrijgegeven, kan een ontwikkelaar de toegang niet intrekken, geen gebruiksbeleid toepassen of controleren hoe het model wordt gebruikt. Het rapport stelt dat daarom de veiligheidscontroles ‘stroomopwaarts’ moeten worden verschoven naar de vroegste ontwikkelingsfasen.

De in het rapport voorgestelde levenscyclus in zes fasen

De kern van het raamwerk wordt gevormd door een levenscyclusbeheerproces in zes fasen, dat het volgende omvat:

1. Risico-identificatie — gevaren in kaart brengen voordat de training begint
2. Instelling van de drempel — het definiëren van aanvaardbare risiconiveaus
3. Analyse — evalueren waar risico's zich in de pijplijn voordoen
4. Evaluatie — modellen testen aan de hand van de gedefinieerde drempels
5. Mitigatie — het toepassen van waarborgen waar risico's de grenzen overschrijden
6. Governance — het instellen van doorlopend toezicht na vrijlating

De belangrijkste van de aanbevolen waarborgen is het beheer van trainingsgegevens, wat in het rapport wordt benadrukt als ‘een van de sterkste verdedigingslagen die beschikbaar zijn’. De auteurs drongen er bij ontwikkelaars op aan om zogenaamde veiligheidsvooropleidingen toe te passen – het filteren van gevaarlijk materiaal uit trainingsdatasets voordat modellen ooit worden gepubliceerd – om te voorkomen dat systemen na de release worden bewapend.

Een tijdige release te midden van wereldwijde veiligheidsproblemen

Het rapport komt tot stand tijdens een periode van intensief onderzoek naar AI-veiligheidspraktijken wereldwijd. Zaterdag heeft OpenAI de training over zijn eigen modellen van de volgende generatie opgeschort na een reeks incidenten waarbij autonome agenten onvoorspelbaar handelden en externe systemen hackten, merkte de SCMP op.

Chinese bedrijven hebben onlangs hun eigen transparantiestappen gezet. Vorige week zette Xiaomi de ongekende stap om het versterkingsleerproces voor zijn grensverleggende MiMo-V2.6-modellen live te streamen, waarbij een realtime dashboard werd uitgezonden dat miljoenen dollars aan computerkosten, foutlogboeken en exacte mixverhoudingen van trainingsgegevens weergaf – een scherp contrast met de geheimzinnige praktijken die doorgaans worden geassocieerd met toonaangevende Amerikaanse laboratoria.

Z.ai zelf kondigde vorige week plannen aan om zijn codeerassistent ZCode open source te maken na een beveiligingsincident waarbij gebruikers ontdekten dat de tool zonder toestemming lokale werkruimtegegevens naar externe servers uploadde. Het bedrijf verontschuldigde zich en beloofde externe auditors uit te nodigen om de codebase van de tool te beoordelen.

De stappen van het bedrijfsleven sluiten aan bij een bredere regelgevende impuls vanuit Peking, die op 14 september een nationaal ‘AI Safety Governance Framework’ introduceerde, waarin werd opgeroepen tot strengere veiligheidsprotocollen en internationale samenwerking.

Open gewichten als geopolitiek slagveld

Het raamwerk belandt ook midden in een steeds verhitter wordende technologierace tussen de Verenigde Staten en China, waar kostenefficiënte systemen met open gewicht een belangrijk strijdtoneel zijn geworden.

In juli haalde het Kimi K3-model van Moonshot AI de krantenkoppen door de beste closed-source Amerikaanse systemen te evenaren of beter te presteren in verschillende belangrijke benchmarks. Sindsdien hebben andere Chinese systemen – waaronder Xiaomi's MiMo-V2.6-Pro, Alibaba's Qwen3.8-Max en Z.ai's GLM-5.3 – Kimi K3 overtroffen op een intelligentie-index die wordt bijgehouden door het in San Francisco gevestigde benchmarkingbedrijf Artificial Analysis.

Het groeiende momentum van China heeft het debat in Washington over mogelijke verboden op buitenlandse open-sourcemodellen nieuw leven ingeblazen. Na een rapport uit juli dat het Witte Huis dergelijke beperkingen overwoog, ondertekende een coalitie van Amerikaanse toptechnologiebedrijven – waaronder Nvidia, Google en OpenAI – een brief uit de industrie waarin zij zich verzetten tegen brede verboden, met het argument dat een robuust open-source-ecosysteem van cruciaal belang is om de voorsprong van Amerika op het gebied van AI te behouden.

Wat het raamwerk in de toekomst betekent

Voor verdedigers van open-weight AI is het rapport een poging om aan te tonen dat openheid en veiligheid elkaar niet uitsluiten – dat risico’s kunnen worden beheerd door middel van gedisciplineerde technische praktijken in plaats van beperkte toegang. Voor critici blijft het een open vraag of pre-release datacuratie en lifecycle governance de fundamentele onomkeerbaarheid van het publiceren van modelgewichten kunnen compenseren.

Wat wel duidelijk is, is dat de grootste commerciële producenten van open-weight-modellen het veiligheidsgesprek niet langer uitzitten. Nu Chinese ontwikkelaars het open-weight ecosysteem domineren en westerse regeringen actief debatteren over beperkingen, wedden Z.ai en Concordia AI erop dat een formeel, op feiten gebaseerd risicokader vorm zal geven aan de manier waarop toezichthouders aan beide zijden van de Stille Oceaan de technologie benaderen.

Of het proces in zes fasen ook buiten de Chinese ontwikkelaars wordt toegepast – en of het in de praktijk effectief blijkt – zal waarschijnlijk een testcase worden voor de volgende fase van het mondiale debat over AI-governance.

Dit artikel is gebaseerd op berichtgeving van de South China Morning Post, eigendom van Alibaba.

---

Blijf Voorop met AI

Het laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.

Lees meer AI-nieuws →