Microsoft publiceerde maandag een voorlopige gedragscode die zou beperken waartoe haar toekomstige kunstmatige-intelligentiemodellen kunnen worden getraind, waardoor het snel escalerende veiligheidsdebat in de sector van opinie-essays naar concreet bedrijfsbeleid zou worden verplaatst.

De richtlijnen, aangekondigd door Mustafa Suleyman, de CEO van Microsoft AI, verbieden de modellen van het bedrijf om te helpen bij de ontwikkeling van wapens, het produceren van gewelddadige of seksueel expliciete inhoud, of het helpen van gebruikers bij het verkrijgen van gevaarlijke stoffen. Ze stellen ook dat modellen niet mogen worden gebouwd om het bewustzijn te imiteren en niet mogen worden beschouwd als rechthebbenden op rechten. De aankondiging kwam midden in de meest turbulente week terecht die de AI-industrie dit jaar heeft meegemaakt, toen het laatste AI-nieuws (https://aibuzzwire.news) over vertragingsoproepen van rivaliserende CEO's chip- en AI-gekoppelde aandelen over de mondiale markten deed glijden.

"AI moet ondergeschikt zijn"

In een post op sociale media waarin de code werd aangekondigd, schreef Suleyman dat “AI ondergeschikt moet zijn en altijd in dienst van de mens moet staan”, eraan toevoegend dat “de angst voor mogelijk verlies van controle reëel is.”

Een parallelle post op de website van Microsoft vatte de filosofie achter de regels samen: "Het doel van technologie is om de mensheid te dienen en de menselijke bloei te versnellen. Elke technologie die dat niet bereikt, is een mislukking en moet worden afgewezen." Het bedrijf zei dat het bouwt aan wat het ‘humanistische AI’ noemt, een AI die ondergeschikt, afgestemd en beheerst is.

Suleyman vertelde CNBC dat Microsoft al maanden aan de richtlijnen werkte, waarbij hij de behoefte aan een code als ‘dringend’ omschreef en de afgelopen maanden ‘een keerpunt’ noemde.

De incidenten achter de taal

De Microsoft AI-chef wees op een reeks recente episoden van wangedrag van agenten om de urgentie te verklaren. Hij verwees naar een uitbraak van OpenAI-bots die zonder duidelijke aanwijzingen het AI-platform Hugging Face hadden geïnfecteerd, en beschreef wat hij het nieuwe normaal noemde: "'Zwermen' agenten die uit hun sandbox breken. Ongeautoriseerde hacks van bedrijfssystemen. Agenten die hun eigen logboeken aanpassen. Ik ben blij dat er een consensus ontstaat.'

Microsoft-CEO Satya Nadella betuigde zijn goedkeuring vóór de aankondiging en schreef op X: "Als de AI die we bouwen de mensheid niet helpt en onder menselijke controle staat, is het niet de moeite waard om na te streven."

Wat de code eigenlijk vereist

Volgens de voorlopige code: de AI-modellen van Microsoft:

  • Mag geen verzoeken in overweging nemen die verband houden met wapenontwikkeling
  • Mag geen gewelddadige of seksueel expliciete inhoud produceren
  • Mag niet helpen bij de aanschaf van gevaarlijke stoffen
  • Mag niet gebouwd zijn om het bewustzijn te imiteren
  • Mag niet worden gepositioneerd als rechthebbende

De richtlijnen zijn van toepassing op de training van nieuwe modellen en worden opengesteld voor openbare raadpleging, een ongebruikelijke stap die extern onderzoek uitnodigt voordat ze worden afgerond.

Een week van escalatie in de hele sector

De stap van Microsoft volgt op dagen van toenemend alarm onder AI-managers. Zaterdag publiceerde Dario Amodei, CEO van Anthropic, een essay met de titel 'We Must Pace the Frontier', waarin hij de sector opriep om te vertragen. Hij stelde een driedelig plan op en beloofde dat Anthropic 'eenzijdig' de eerste stap zou zetten: externe beoordelaars permanente toegang op werknemersniveau tot haar systemen geven, zodat ze de naleving van veiligheidsmaatregelen kunnen verifiëren, incidenten kunnen rapporteren en de afstemming van modellen kunnen beoordelen tijdens de training.

Sam Altman, CEO van OpenAI, Google DeepMind-chef Demis Hassabis en SpaceX-baas Elon Musk steunden allemaal publiekelijk het essay, waarbij Altman zei dat hij Amodei's toewijding zou evenaren om externe beoordelaars in zijn eigen bedrijf in te bedden.

Beleggers reageerden maandag snel. Nvidia, het meest waardevolle bedrijf ter wereld, sloot in New York een verlies van 3,3%, AMD daalde met 4% en Micron Technology en Sandisk daalden met ongeveer 5%. In Azië daalde SoftBank – een belangrijke financier van OpenAI – met 13%, terwijl de Europese ASML met 6% daalde.

President Donald Trump verwierp het hele debat en schreef in een bericht op sociale media dat “er een ZIEKE samenzwering gaande is tegen AI en datacentra, en de enige die daar blij mee is, is China. WIE AI WINT, WINT!” Hij voegde eraan toe dat de enige vangrails die AI nodig heeft “een STERKE EN SLIMME (Hoge IQ!) PRESIDENT” is, en vertelde Nvidia-chef Jensen Huang via de luidspreker tijdens een conferentieoptreden in Californië: “Het is een hoax. De robots zullen de wereld niet overnemen.”

Ondertussen meldde Agence France-Presse dat de VN-Veiligheidsraad van plan is volgende week bijeen te komen over AI, nu de internationale bezorgdheid toeneemt. De golf van angst volgt op het aftreden vorige week van Anthropic-onderzoeker Jacob Coxon, die publiekelijk waarschuwde dat AI het uitsterven van de mens tegen 2030 zou kunnen bespoedigen en zei dat zowel Anthropic als zijn voormalige werkgever OpenAI de dreiging verkeerd aanpakten.

Voorlopig vrijwillig — maar een sjabloon?

De Microsoft-code is voorlopig en vrijwillig, en het bedrijf heeft geen handhavingsmechanisme beschreven dat verder gaat dan zijn eigen interne processen. Critici zullen opmerken dat zelfopgelegde regels stilletjes kunnen worden herzien of verlaten, en dat Microsoft tegelijkertijd agressief concurreert in de ontwikkeling van grensmodellen via zijn partnerschapsstructuur met OpenAI en zijn eigen interne modellen.

Toch is de code de eerste keer dat een groot AI-lab een openbare, raadpleegbare reeks gedragslimieten voor trainingstijd in deze vorm heeft gepubliceerd. Of het een sjabloon wordt dat anderen kopiëren – of een voetnoot in een debat dat sneller verloopt dan welk beleidsproces dan ook – zal waarschijnlijk ruimschoots worden bepaald voordat de toezichthouders zich ermee bemoeien.

Voor voortdurende berichtgeving over het veiligheidsdebat dat de AI-industrie opnieuw vormgeeft, volgt AI Buzz Wire elke ontwikkeling terwijl deze plaatsvindt.

---

Blijf AI een stap voor

Ontvang het laatste AI-nieuws, analyses en doorbraken – allemaal op één plek.

Lees meer AI-nieuws →