Microsoft lanceerde vrijdag Microsoft-Decision-1, een gespecialiseerd model voor snelle, gestructureerde besluitvorming, op zijn Foundry-platform – en bouwde het op Alibaba’s open-weight Qwen3.5-9B in plaats van op enig model van zijn naaste partner OpenAI, meldde The New Stack.
De lancering vindt plaats drie dagen nadat OpenAI zijn Decisions API heeft opengesteld voor elke ontwikkelaar in de publieke bèta, en op dezelfde dag kondigde TypeSafe, de startup die ongeveer drie en een halve week geleden de categorie beslissingsmodellen met Jev op gang bracht, een Series A van $ 870 miljoen aan tegen een waardering van $ 7,5 miljard onder leiding van a16z. Microsoft heeft Decision-1 precies op het tarief van Jev geprijsd: $0,042 per miljoen inputtokens met gratis output. Voor meer informatie over de toenemende race om AI goedkoper en sneller te maken, zie onze voortdurende AI-industrieverslaggeving.
Geprijsd om bij Jev te passen, gebouwd op de open gewichten van een rivaal
Decision-1 is een post-getraind model: Microsoft is uitgegaan van Alibaba's Qwen3.5-9B en heeft dit afgestemd op gestructureerde beslissingstaken in plaats van op generatie met een open einde. Het bedrijf zegt dat het van plan is het model opnieuw te baseren op zijn eigen MAI-modellen en op die van OpenAI, maar de aanvankelijke keuze voor een Chinese open-weight-basis is opmerkelijk voor een bedrijf dat miljarden investeert in OpenAI.
Microsoft is ook verre van de eerste beweger. In de drie en een halve week sinds de lancering van Jev hebben OpenAI, Upstage, Perplexity, Cloudflare en AWS allemaal hun eigen beslissingsmodellen uitgebracht, aldus The New Stack. De Qwen3.5-basis die Microsoft heeft gekozen, is een soort standaard in de industrie geworden: Jared Palmer, vice-president engineering van Cognition, heeft ongeveer $ 95 uitgegeven aan Modal H100-computers om zijn open-source Kev-modellen over te zetten naar Qwen3.5, en Cloudflare bouwde zijn Clef-flash-model op dezelfde Qwen3.5-9B-basis.
De prijs convergeert ook. Palmer vermeldt Kev-4B op OpenRouter voor $ 0,042 per miljoen invoertokens, Perplexity rekent $ 0,02 aan, en OpenAI rekent meer dan het dubbele van het tarief van Jev. Tegen deze prijzen zijn de inkomsten uit individuele beslissingsgesprekken minimaal, wat erop wijst dat de grotere kans van Microsoft erin bestaat om het verkeer van agenten, inclusief de generatieve gesprekken rond elke beslissing, via Foundry te laten verlopen.
Microsoft is zijn eigen eerste klant
Microsoft-voorzitter en CEO Satya Nadella kondigde het model vrijdag op X aan en schreef dat Decision-1 "topprestaties levert op gestructureerde beslissingstaken, beter presteert dan zowel LLM's als andere beslissingsmodellen op het gebied van latentie en kwaliteit", en voegde eraan toe: "We testen het al bij Microsoft."
Vier interne teams ondersteunden dat, volgens The New Stack. Xbox Research gebruikte Decision-1 om meer dan 10.000 spelersfeedback te sorteren. Het Copilot-team beoordeelde er chat- en agentreacties mee. Technici op afroep gebruikten het om context op te halen tijdens live-incidenten, en Microsoft Discovery gebruikte het om experimenten te scoren voordat een agent opnieuw zou plannen.
De interne cijfers van Microsoft beweren, zoals gerapporteerd, dat het model meer dan 14 keer zo snel is als GPT-6 Sol, tegen een fractie van de kosten voor de Xbox-werklast, en 46 keer consistenter in Discovery. Achint Srivastava, vice-president software engineering bij Microsoft's Office of the CTO, introduceerde Decision-1 als een manier om besluitvorming toe te voegen aan bestaande applicaties, agents en workflows "in een veilige, vertrouwde omgeving."
Wat Decision-1 niet kan doen
De lancering laat ook zien waar Microsoft de concurrentie achter zich laat. De Foundry-lijst van Decision-1 zegt dat het maximaal 32.768 tokens aan tekst accepteert en JSON retourneert, maar het ondersteunt geen afbeeldingen – in tegenstelling tot OpenAI's Decisions API en Cloudflare's Clef, die een vision-encoder gebruiken. En hoewel Cloudflare Clef heeft uitgebracht onder de tolerante Apache 2.0-licentie, heeft Microsoft geen open gewichten aangekondigd voor Decision-1.
Er is ook een compatibiliteitsvraag. AWS, Upstage en Ollama hebben TypeSafe's System One API overgenomen, nu een gemeenschappelijke interface in de hele categorie, maar Microsoft heeft niet gezegd of Decision-1 volledig compatibel is - hoewel de Foundry-voorbeeldcode een /systemone-eindpunt aanroept.
Kalibratieclaims verdienen ook onderzoek. Microsoft zegt dat de kansen van Decision-1 gekalibreerd zijn, wat betekent dat een voorspelling van 90% ongeveer negen keer op de tien juist zou moeten zijn in representatieve gevallen, en de eigen documentatie van het bedrijf adviseert klanten om de kalibratie op hun gegevens te valideren. Die voorzichtigheid weerspiegelt de JevOut-preprint, waarin computerwetenschapper Zixiang Xu en co-auteurs van het USC ontdekten dat korte, natuurlijk klinkende toevoegingen aan de context 312 van Jev's 508 aanvankelijk correcte beslissingen omdraaiden - en in 229 gevallen kende Jev een waarschijnlijkheid van ten minste 70% toe aan het verkeerde antwoord. Drie andere scoresystemen lieten bij dezelfde testaanpak een fliprate tussen 64,9% en 73,2% zien. Microsoft zegt dat het Decision-1 heeft getest met acht soorten verstoringen, waaronder opnieuw geordende opties en geparafraseerde beschrijvingen.
Routeringsbeslissingen over Copilot, GitHub en Xbox
Het model heeft mogelijk een grotere klus voor de boeg. Woensdag zei Microsoft dat GitHub Copilot binnenkort zal beslissen wanneer een taak op het apparaat moet worden uitgevoerd en wanneer deze naar modellen op cloudschaal moet worden gestuurd, hoewel het niet heeft bekendgemaakt wat Copilot naar de cloud verzendt. Modelroutering is een van de gebruiksscenario's die Microsoft opsomt voor Decision-1, maar het bedrijf heeft niet bevestigd dat het model deze oproepen zal doen. Nu routeringsbeslissingen moeten worden genomen over Copilot, GitHub en Xbox, heeft Microsoft een stimulans om deze intern af te handelen.
De concurrentiebelangen zijn zichtbaar in de tractie van TypeSafe. TypeSafe CEO Diogo Almeida postte op X dat "29,4% van de Fortune 500 verscheen" in de drie weken sinds de lancering van Jev, dat het model "per ongeluk biljoenen tokens per dag leverde", en, met het oog op de werklast van zijn team, dat "het al drie weken geleden is dat we nu graag zouden willen slapen." Dat zijn dezelfde bedrijven waar Microsoft Azure aan verkoopt – wat de komst van Decision-1 niet zozeer een weddenschap op een nieuwe markt maakt als wel een verdediging van een bestaande markt.
---
Blijf AI een stap voorOntvang het laatste AI-nieuws, analyses en doorbraken – allemaal op één plek.
Lees meer AI-nieuws →

