מיקרוסופט השיקה ביום שישי את Microsoft-Decision-1, מודל מיוחד לקבלת החלטות מהירה ומובנית, בפלטפורמת היציקה שלה - ובנתה אותו על המשקל הפתוח של עליבאבא Qwen3.5-9B ולא על כל דגם מהשותפה הקרובה שלה OpenAI, כך דיווח The New Stack.

ההשקה נוחתת שלושה ימים לאחר ש-OpenAI פתחה את Decisions API שלה לכל מפתח בגרסת בטא ציבורית, ובאותו יום TypeSafe, הסטארט-אפ שהצית את קטגוריית מודל ההחלטות עם Jev לפני כשלושה וחצי שבועות, הכריזה על סדרה A של 870 מיליון דולר לפי שווי של 7.5 מיליארד דולר בהובלת a16z. מיקרוסופט תמחרה את Decision-1 בדיוק בתעריף של Jev: $0.042 למיליון אסימוני קלט עם פלט חופשי. למידע נוסף על המירוץ המואץ להפיכת הבינה המלאכותית לזולה ומהירה יותר, עיין בסיקור תעשיית הבינה המלאכותית שלנו.

במחיר תואם ל-JV, בנוי על משקלים פתוחים של יריב

Decision-1 הוא מודל שלאחר הכשרה: מיקרוסופט התחילה מ-Qwen3.5-9B של עליבאבא וכיוונה אותו למשימות החלטה מובנות ולא לדור פתוח. החברה אומרת שהיא מתכננת לבסס מחדש את המודל על דגמי MAI משלה כמו גם של OpenAI, אך הבחירה הראשונית בבסיס סיני בעל משקל פתוח בולטת לחברה שמשקיעה מיליארדים ב-OpenAI.

גם מיקרוסופט רחוקה מלהיות המניע הראשון. בשלושה וחצי השבועות מאז השקת Jev, OpenAI, Upstage, Perplexity, Cloudflare ו-AWS שלחו כולן דגמי החלטה משלהם, לפי The New Stack. בסיס ה-Qwen3.5 שבחרה מיקרוסופט הפך לברירת מחדל בתעשייה: סגן נשיא ההנדסה של Cognition, ג'ארד פאלמר, הוציא כ-95 דולר במחשוב Modal H100 בהעברת דגמי ה-Kev שלו בקוד פתוח ל-Qwen3.5, ו-Cloudflare בנתה את דגם ה-Clef-flash שלה על אותו בסיס Qwen3.5-9B.

גם המחיר מתכנס. פאלמר מציגה את Kev-4B ב-OpenRouter במחיר של 0.042$ למיליון אסימוני קלט, Perplexity גובה 0.02$, ו-OpenAI גובה יותר מכפול מהתעריף של Jev. במחירים אלה, ההכנסה משיחות החלטה בודדות היא מינימלית - מה שמרמז על ההזדמנות הגדולה יותר של מיקרוסופט היא לשמור על תעבורת סוכנים, כולל השיחות היצירתיות סביב כל החלטה, לרוץ דרך Foundry.

מיקרוסופט היא הלקוח הראשון שלה

יו"ר ומנכ"ל מיקרוסופט, Satya Nadella, הכריז על המודל ב-X ביום שישי, וכתב כי Decision-1 "מספקת ביצועים מובילים במשימות החלטה מובנות, מעלה ביצועים טובים יותר הן של LLMs והן על מודלים של החלטות אחרים בהשהיה ובאיכות", והוסיפה, "אנחנו כבר בודקים אותו ברחבי מיקרוסופט".

ארבעה צוותים פנימיים גיבו זאת, לפי The New Stack. Xbox Research השתמש ב-Decision-1 כדי למיין יותר מ-10,000 קטעי משוב של שחקנים. צוות Copilot דירג איתו את תגובות הצ'אט והסוכנים. מהנדסים בכוננות השתמשו בו כדי למשוך הקשר במהלך אירועים חיים, ו-Microsoft Discovery השתמשה בו כדי לצבור ניסויים לפני שסוכן מתכנן מחדש.

המספרים הפנימיים של מיקרוסופט, כפי שדווח, טוענים שהדגם מהיר יותר מפי 14 מה-GPT-6 Sol בשבריר מהעלות של עומס העבודה של Xbox, ופי 46 יותר עקבי ב-Discovery. Achint Srivastava, סגן נשיא להנדסת תוכנה במשרד ה-CTO של מיקרוסופט, הציג את Decision-1 כדרך להוסיף קבלת החלטות ליישומים, סוכנים וזרימות עבודה קיימים "בסביבה מאובטחת ומהימנה".

מה החלטה-1 לא יכולה לעשות

ההשקה גם מראה היכן מיקרוסופט עוקבת אחרי יריבות. רישום ה-Foundry של Decision-1 אומר שהוא מקבל עד 32,768 אסימונים של טקסט ומחזיר JSON, אבל הוא לא תומך בתמונות - בניגוד ל-Decisions API של OpenAI ול-Clef של Cloudflare, שמשתמש במקודד vision. ובעוד Cloudflare שחררה את Cle תחת רישיון Apache 2.0 המתירני, מיקרוסופט לא הכריזה על משקלים פתוחים עבור Decision-1.

יש גם שאלת תאימות. AWS, Upstage ו-Ollama אימצו את System One API של TypeSafe, כעת ממשק נפוץ בכל הקטגוריה, אך מיקרוסופט לא אמרה אם Decision-1 תואם באופן מלא - אם כי קוד הדוגמה של Foundry שלה קורא לנקודת קצה /systemone.

גם טענות כיול ראויות לבדיקה. מיקרוסופט אומרת שההסתברויות של Decision-1 מכוילות, כלומר תחזית של 90% צריכה להיות נכונה בערך פי תשע מתוך עשרה במקרים מייצגים, והתיעוד של החברה עצמה מייעץ ללקוחות לאמת כיול על הנתונים שלהם. זהירות זו מהדהדת את ההדפסה המוקדמת של JevOut, שבה חוקר מדעי המחשב של USC Zixiang Xu ומחברים משותפים מצאו כי תוספות קצרות וטבעיות להקשר הפכו 312 מתוך 508 ההחלטות הנכונות בתחילה של Jev - וב-229 מקרים Jev הקצה לפחות 70% הסתברות לתשובה השגויה. שלוש מערכות ניקוד אחרות הראו שיעורי היפוך בין 64.9% ל-73.2% באותה גישת בדיקה. מיקרוסופט אומרת שהיא בדקה את Decision-1 עם שמונה סוגים של הפרעות, כולל אפשרויות מסודרות מחדש ותיאורים מפורשים.

ניתוב החלטות בין Copilot, GitHub ו-Xbox

לדגם עשויה להיות עבודה גדולה יותר לפניה. ביום רביעי אמרה מיקרוסופט ש-GitHub Copilot תחליט בקרוב מתי להפעיל משימה במכשיר ומתי לשלוח אותה לדגמים בקנה מידה של ענן, אם כי היא לא חשפה מה Copilot שולח לענן. ניתוב מודלים הוא בין מקרי השימוש שמיקרוסופט רושמת עבור Decision-1, אך החברה לא אישרה שהמודל יבצע את השיחות הללו. עם החלטות ניתוב שיש לקבל בין Copilot, GitHub ו-Xbox, למיקרוסופט יש תמריץ לטפל בהן בתוך הבית.

ההימור התחרותי גלוי במשיכה של TypeSafe. מנכ"ל TypeSafe, דיוגו אלמיידה, פרסם ב-X כי "29.4% מה-Fortune 500 הופיעו" בשלושת השבועות מאז השקת Jev, שהדגם "שימש בטעות טריליוני אסימונים ביום", ועם עין על עומס העבודה של הצוות שלו, ש"עברו 3 שבועות שהיינו רוצים לישון עכשיו". אלה אותם ארגונים שמיקרוסופט מוכרת להם את Azure - מה שהופך את ההגעה של Decision-1 לפחות הימור על שוק חדש מאשר הגנה על שוק קיים.

---

הישאר לפני AI

קבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.

קרא עוד חדשות AI →