Microsoft publicerade en provisorisk uppförandekod på måndagen som skulle begränsa vad dess framtida modeller för artificiell intelligens kan tränas för att göra, vilket flyttar branschens snabbt eskalerande säkerhetsdebatt från åsiktsuppsatser till konkret företagspolicy.

Riktlinjerna, tillkännagivna av Mustafa Suleyman, vd för Microsoft AI, hindrar företagets modeller från att hjälpa till med vapenutveckling, producera våldsamt eller sexuellt explicit innehåll eller hjälpa användare att skaffa farliga ämnen. De slår också fast att modeller inte ska byggas för att imitera medvetandet och inte ska betraktas som berättigade till rättigheter. Tillkännagivandet landade i mitten av den mest turbulenta veckan som AI-branschen har sett i år, då bristande AI-nyheter av avmattningssamtal från rivaliserande vd:ar skickade chip- och AI-länkade aktier som sjönk över globala marknader.

"AI måste vara underordnad"

I ett inlägg på sociala medier som tillkännagav koden skrev Suleyman att "AI måste vara underordnad och alltid i tjänst för människor", och tillade att "rädslorna för eventuell förlust av kontroll är verkliga."

Ett parallellt inlägg på Microsofts webbplats ramade in filosofin bakom reglerna: "Syftet med teknik är att tjäna mänskligheten och påskynda mänsklig blomstring. All teknik som inte uppnår det är ett misslyckande, och den bör förkastas." Företaget sa att det bygger mot vad det kallar "Humanistisk AI, en som är underordnad, anpassad och innesluten."

Suleyman berättade för CNBC att Microsoft hade arbetat med vägledningen i flera månader, och beskrev behovet av en kod som "brådskande" och kallade de senaste månaderna "en vattendelare".

Incidenterna bakom språket

Microsoft AI-chefen pekade på en serie av nyligen inträffade episoder av agentmissbruk för att förklara hur brådskande det är. Han hänvisade till ett utbrott av OpenAI-botar som hade infekterat AI-plattformen Hugging Face utan uppenbar riktning, och beskrev vad han kallade det nya normala: "'Svärmar' av agenter som bryter sig ut ur sina sandlådor. Otillåtna hack av företagsklassiga system. Agenter som modifierar sina egna loggar. Jag är glad att en konsensus bildas."

Microsofts vd Satya Nadella signalerade sitt stöd före tillkännagivandet och skrev på X: "Om AI:n vi bygger inte hjälper mänskligheten och under mänsklig kontroll, är det inte värt att fortsätta."

Vad koden faktiskt kräver

Under den provisoriska koden, Microsofts AI-modeller:

– Får inte beakta förfrågningar relaterade till vapenutveckling

  • Får inte producera våldsamt eller sexuellt explicit innehåll

– Får inte hjälpa till med upphandling av farliga ämnen
– Bör inte byggas för att imitera medvetandet
  • Bör inte positioneras som berättigad till rättigheter

Riktlinjerna gäller utbildning av nya modeller och håller på att öppnas för offentligt samråd, ett ovanligt steg som uppmanar till extern granskning innan de slutförs.

En vecka av upptrappning i branschen

Microsofts drag följer efter dagar av ökande larm bland AI-chefer. På lördagen publicerade Anthropics vd Dario Amodei en uppsats med titeln "We Must Pace the Frontier" som vädjar till branschen att sakta ner, lägger fram en plan i tre delar och förbinder sig att Anthropic "ensidigt" skulle ta det första steget: att ge tredjepartsutvärderare permanent åtkomst på anställd nivå till sina system så att de kan verifiera efterlevnaden av säkerhetsåtgärder, bedöma efterlevnad av säkerhetsåtgärder och utvärdera modellincidenter.

OpenAI VD Sam Altman, Google DeepMind-chef Demis Hassabis och SpaceX-chef Elon Musk stödde alla uppsatsen offentligt, och Altman sa att han skulle matcha Amodeis engagemang för att bädda in externa utvärderare i sitt eget företag.

Investerare reagerade snabbt på måndagen. Nvidia, världens mest värdefulla företag, stängde ned 3,3% i New York, AMD sjönk 4% och Micron Technology och Sandisk föll med cirka 5%. I Asien sjönk SoftBank – en stor OpenAI-stödjare – 13 %, medan Europas ASML sjönk 6 %.

President Donald Trump avfärdade hela debatten och skrev i ett inlägg på sociala medier att "det pågår en SJUK konspiration mot AI och datacenter, och den enda som är glad över det är Kina. DEN SJUKT VINNER AI, VINNER!" Han tillade att de enda skyddsräcken AI behöver är "en STARK OCH SMART (Hög IQ!) PRESIDENT", och sa till Nvidia-chefen Jensen Huang via högtalartelefon under ett konferensframträdande i Kalifornien: "Det är en bluff. Robotarna kommer inte att ta över världen."

Samtidigt rapporterade Agence France-Presse att FN:s säkerhetsråd planerar att träffas om AI nästa vecka när den internationella oron ökar. Vågen av ångest följer på förra veckans avgång av antropisk forskare Jacob Coxon, som offentligt varnade för att AI skulle kunna påskynda mänsklig utrotning till 2030 och sa att både Anthropic och hans tidigare arbetsgivare OpenAI misskötte hotet.

Frivilligt för tillfället – men en mall?

Microsoft-koden är provisorisk och frivillig, och företaget har inte beskrivit en tillämpningsmekanism utöver sina egna interna processer. Kritiker kommer att notera att självpåtagna regler kan revideras eller överges i det tysta, och att Microsoft samtidigt konkurrerar aggressivt i frontiermodellutveckling genom sin partnerskapsstruktur med OpenAI och sina egna interna modeller.

Ändå är koden första gången ett stort AI-labb har publicerat en offentlig, konsultabel uppsättning av beteendegränser för träningstid i denna form. Om det blir en mall som andra kopierar – eller en fotnot i en debatt som går snabbare än någon policyprocess – kommer sannolikt att avgöras långt innan tillsynsmyndigheter väger in.

För fortsatt täckning av säkerhetsdebatten som omformar AI-branschen, spårar AI Buzz Wire varje utveckling när den sker.

---

Stay ahead of AI

Få de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.

Läs mer AI-nyheter →