זהותו של Ox Alpha, מודל הבינה המלאכותית הלא ממותגת ששלט בשיחות מפתחים מאז הופיע ב-OpenRouter וב-OpenCode ב-20 באוגוסט, אינה עוד בגדר תעלומה. ה-Z.AI הסינית אישרה לחדשות בלומברג ביום רביעי שהדגם הוא איטרציה חדשה של סדרת ה-GLM שלה - ואמרה שהיא תשחרר את משקלי הדגם הלילה, מה שהופך אותם לזמינים להורדה ולהרצה של כל אחד.

האישור מסיים את אחד ממשחקי הניחוש המטורפים ביותר שראתה קהילת הבינה המלאכותית השנה, והוא מעמיד דגם סיני בדרגת דגל למסלול התנגשות עם מעבדות מערביות שמתמחרות יכולות דומות במחיר גבוה. For more context on this story, see our ongoing breaking AI news.

השקה חמקנית שעבדה בדיוק כפי שתוכננה

Ox Alpha הגיע עם רשימה שתיארה הכל על מה שהיא יכולה לעשות ושום דבר על מי שבנה אותה. OpenRouter ייחס את זה ל"ספק צד שלישי שבחר להישאר אנונימי במהלך התצוגה המקדימה הזו", ומיקם אותו כמודל נימוק שנבנה לקידוד, עבודה סוכנת מתמשכת ועומסי ייצור.

המפרט לבדו הספיק כדי לסובב ראשים: חלון הקשר של קצת יותר ממיליון אסימונים, תמיכה בקלט טקסט, תמונה ווידאו, וגישה חופשית לחלוטין דרך OpenRouter ו-OpenCode. OpenCode פרסמה קיבולת הגשה של 100 טריליון אסימונים ליום עבור הדגם, ו-Nous Research טענה שהפורטל שלה יכול לדחוף קוודריליון אסימונים.

הפעלת מודל צמוד לגבולות באופן אנונימי על תשתית ניטרלית מאפשרת ל-Z.AI לאסוף נתוני שימוש אמיתיים ופטפוטים לא מסוננים לפני הצמדת המותג שלה - ספר הפעלה שעוקף את נרטיב ההנחה שעוקב אחרי כל מהדורה סינית בעלת משקל פתוח, כפי שציינה OfficeChai בניתוח של ההשקה.

ריצת המדד שהדליקה את הפתיל

המאניה חוזרת לנקודת נתונים אחת. תוך יום מהשחרור, המפתח בן דייוויס ערך הערכה לא רשמית של עשר משימות על מדד DeepSWE ודיווח על דיוק של 80 אחוזים במעבר ראשון עבור Ox Alpha - לפני קלוד פייבל 5 ב-65 אחוזים ו-GPT-5.6 Sol ב-52 אחוזים.

התוצאה הזו הספיקה כדי לשלוח את הדגם ויראלי ולסיים את רצף 56 הימים של DeepSeek בראש טבלת ה-OpenCode. זה גם משך דחיפה מיידית. ב-Hacker News, שם האישור של בלומברג צבר מאות תגובות, המפתחים דחקו בזהירות, וציינו כי ריצה של עשר משימות היא מדגם קטן מדי מכדי להסדיר משהו ושהתוצאות של המודל בטבלאות תוצאות אחרות היו מעורבות יותר באופן ניכר.

איך האינטרנט פיצח את המקרה הראשון

הרבה לפני האישור ביום רביעי, עבודת הבילוש הקהילתית כבר התיישבה על Z.AI - שנקרא בעבר Zhipu AI - כמועמד המוביל. מפתח אחר "דאקס" ערך בדיקת טביעת אצבע של טוקנייזר על פני 25 הנחיות ומצא כי ספירת האסימונים הגולמית של Ox Alpha תואמת את הטוקנייזר של GLM ב-11 מתוך 11 בדיקות, בעוד שאף דגם של מעבדה אחר לא סידר ארבעה. בבדיקה ספרתית אחת, הטוקנייזר של DeepSeek שרף 98 אסימונים כאשר GLM השתמש ב-29.

ניתוח נפרד מצא ש-Ox Alpha נקלע לאותו "אסימון מלוכלך" שהכשיל את המודלים של משפחת Qwen ו-GLM באופן היסטורי, והצמצם את התחום למעבדה סינית בשלב מוקדם. התיאוריה הבולטת הנוספת - Xiaomi, שצוות ה-MiMo שלה ניהל בעבר ספר הפעלה זהה עם MiMo-V2-Pro תחת הכינוי Hunter Alpha - נראה כעת כפתיל.

ההימור של הגילוי משתרע מעבר לזכויות התרברבות. ה"ניו יורק טיימס" דיווח שלשום כי שחרור מודל של מעבדה סינית עשוי לבחון את המוכנות העולמית לאבטחת סייבר, ולהדגיש עד כמה ממשלות מערביות עוקבות מקרוב אחר פרסומים בעלי משקל פתוח בקליבר הזה.

מדוע משקלים פתוחים משנים את החשבון

האישור של Z.AI שהמשקולות מגיעות הערב הוא החלק שחשוב לשוק. ה-GLM 5.3 הנוכחי של החברה מתומחר ב-$1.40 למיליון אסימוני קלט ו-$4.40 למיליון אסימוני פלט ב-API של הצד הראשון שלה, עם הנחה של 81 אחוז במטמון. הדגם החדש צפוי להישלח תחת אותו רישיון MIT בו השתמש Z.AI מאז GLM 5, על פי OfficeChai.

הקידוד והביצועים הסמוכים לגבול, שפורסמו בגלוי בשבריר מתמחור ה-API המערבי, היא בדיוק נקודת הלחץ שמעבדות הפרימיום בילו שנתיים בניסיון להימנע ממנה. זה גם שומר על Z.AI תחרותי עם DeepSeek בצד המשקל הפתוח של השוק הסיני, שבו דגמים הניתנים להורדה חופשית הפכו לציפיות ברירת המחדל לכל דבר שהוא פחות מהגבול המוחלט של המעבדה.

במה לצפות בהמשך

הפרטים העיקריים נותרו לא מאושרים - והכי חשוב ספירת הפרמטרים וגודל הדגם, שיקבעו עד כמה הפריסה מעשית לפריסה מקומית. הדיון בקהילה כבר התאפס על האופן שבו המודל מגיב לכימות וכמה מהר הוא פועל על חומרה לצרכן ולא על GPUs במרכז הנתונים.

מה שבטוח הוא ששבוע של ספקולציות אנונימיות נתן ל-Z.AI משהו ששום תקציב שיווקי לא יכול היה לקנות: אימות חסר פניות, אגנוסטי למותג על קרקע ניטרלית. עכשיו שלדגם יש שם, המדדים עומדים להיות הרבה יותר צפופים - וקפדניים הרבה יותר.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →