Microsoft lanserade på fredagen Microsoft-Decision-1, en specialiserad modell för snabbt, strukturerat beslutsfattande, på sin Foundry-plattform – och byggde den på Alibabas öppna Qwen3.5-9B snarare än på någon modell från sin nära partner OpenAI, rapporterade The New Stack.

Lanseringen landar tre dagar efter att OpenAI öppnade sitt Decisions API för alla utvecklare i offentlig beta, och samma dag tillkännagav TypeSafe, startupen som tände beslutsmodellkategorin med Jev för ungefär tre och en halv vecka sedan, en serie A på 870 miljoner dollar till en värdering på 7,5 miljarder dollar ledd av a16z. Microsoft prissatte Decision-1 till exakt Jevs pris: 0,042 USD per miljon inmatade tokens med gratis utdata. För mer om det accelererande loppet för att göra AI billigare och snabbare, se vår pågående AI-industribevakning.

Prissatt för att matcha Jev, byggd på en rivals öppna vikter

Decision-1 är en eftertränad modell: Microsoft utgick från Alibabas Qwen3.5-9B och trimmade den för strukturerade beslutsuppgifter snarare än öppen generering. Företaget säger att de planerar att bygga om modellen på sina egna MAI-modeller såväl som OpenAI:s, men det initiala valet av en kinesisk bas med öppen vikt är anmärkningsvärt för ett företag som investerar miljarder i OpenAI.

Microsoft är också långt ifrån first mover. Under de tre och en halv veckorna sedan Jev lanserades har OpenAI, Upstage, Perplexity, Cloudflare och AWS alla skickat egna beslutsmodeller, enligt The New Stack. Qwen3.5-basen som Microsoft valde har blivit något av en industristandard: Cognitions vice VD för teknik, Jared Palmer, spenderade cirka 95 USD på Modal H100-datorer för att porta sina Kev-modeller med öppen källkod till Qwen3.5, och Cloudflare byggde sin Clef-flash-modell på samma Qwen3.5-9B-bas.

Priset konvergerar också. Palmer listar Kev-4B på OpenRouter till $0,042 per miljon inmatade tokens, Perplexity tar $0,02 och OpenAI tar mer än dubbelt Jevs pris. Till dessa priser är intäkterna från individuella beslutssamtal minimala – vilket tyder på att Microsofts större möjlighet är att hålla agenttrafiken, inklusive de generativa samtalen kring varje beslut, löpande genom Foundry.

Microsoft är sin egen första kund

Microsofts ordförande och VD Satya Nadella tillkännagav modellen på X på fredagen, och skrev att Decision-1 "levererar högsta prestanda för strukturerade beslutsuppgifter, överträffar både LLM:er och andra beslutsmodeller i latens och kvalitet" och tillägger: "Vi testar redan det över hela Microsoft."

Fyra interna team backade upp det, per The New Stack. Xbox Research använde Decision-1 för att sortera mer än 10 000 spelares feedback. Copilot-teamet betygsatte chatt- och agentsvar med det. Jourutvecklare använde det för att dra sammanhang under liveincidenter, och Microsoft Discovery använde det för att poängsätta experiment innan en agent planerar om.

Microsofts interna siffror, som rapporterats, hävdar att modellen är mer än 14 gånger så snabb som GPT-6 Sol till en bråkdel av kostnaden för Xbox-arbetsbelastningen och 46 gånger mer konsekvent i Discovery. Achint Srivastava, vice vd för programvaruteknik på Microsofts CTO-kontor, introducerade Decision-1 som ett sätt att lägga till beslutsfattande till befintliga applikationer, agenter och arbetsflöden "i en säker, pålitlig miljö."

Vad beslut-1 inte kan göra

Lanseringen visar också var Microsoft följer konkurrenterna. Decision-1:s Foundry-lista säger att den accepterar upp till 32 768 tokens av text och returnerar JSON, men den stöder inte bilder – till skillnad från OpenAI:s Decisions API och Cloudflares Clef, som använder en vision-kodare. Och medan Cloudflare släppte Clef under den tillåtande Apache 2.0-licensen, har Microsoft inte meddelat öppna vikter för beslut-1.

Det finns också en kompatibilitetsfråga. AWS, Upstage och Ollama har antagit TypeSafes System One API, nu ett vanligt gränssnitt i kategorin, men Microsoft har inte sagt om Decision-1 är helt kompatibel - även om dess Foundry-exempelkod anropar en /systemone-slutpunkt.

Kalibreringspåståenden förtjänar också granskning. Microsoft säger att Decision-1:s sannolikheter är kalibrerade, vilket innebär att en 90 % förutsägelse borde vara rätt ungefär nio gånger av tio i representativa fall, och företagets egen dokumentation råder kunder att validera kalibrering på sina data. Den försiktigheten återspeglar JevOut-förtrycket, där USC-datavetenskapsforskaren Zixiang Xu och medförfattare fann att korta, naturligt klingande tillägg till sammanhanget vände 312 av Jevs 508 initialt korrekta beslut – och i 229 fall tilldelade Jev minst 70 % sannolikhet för fel svar. Tre andra poängsystem visade växlingshastigheter mellan 64,9 % och 73,2 % under samma testmetoder. Microsoft säger att de testade Decision-1 med åtta typer av störningar, inklusive omordnade alternativ och omskrivna beskrivningar.

Routing-beslut över Copilot, GitHub och Xbox

Modellen kan ha ett större jobb framför sig. På onsdagen sa Microsoft att GitHub Copilot snart kommer att bestämma när en uppgift ska köras på enheten och när den ska skickas till molnskalamodeller, även om det inte har avslöjat vad Copilot skickar till molnet. Modellrouting är bland de användningsfall som Microsoft listar för Decision-1, men företaget har inte bekräftat att modellen kommer att göra dessa samtal. Med routingbeslut att fatta mellan Copilot, GitHub och Xbox har Microsoft ett incitament att hantera dem internt.

De konkurrenskraftiga insatserna är synliga i TypeSafes dragkraft. TypeSafes VD Diogo Almeida skrev på X att "29,4% av Fortune 500 dök upp" under de tre veckorna sedan Jev lanserades, att modellen "av misstag serverade biljoner tokens om dagen" och, med ett öga på hans teams arbetsbelastning, att "det har gått 3 veckor som vi skulle vilja sova nu." Det är samma företag som Microsoft säljer Azure till – vilket gör ankomsten av Decision-1 till mindre en satsning på en ny marknad än ett försvar av en befintlig.

---

Stay ahead of AI

Få de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.

Läs mer AI-nyheter →