Z.ai, מעבדת הבינה המלאכותית הסינית שנודעה בעבר בשם Zhipu AI, פרסמה את המשקולות המלאות של דגם ה-GLM-5.3 שלה ב-Huging Face, והפכה את אחד מדגמי הקידוד והסוכנים החזקים ביותר הזמינים להורדה בחינם. השחרור יצא לאוויר ב-28 באוגוסט, ימים ספורים לאחר שהמעבדה אישרה שדגם ההתגנבות הוויראלי המכונה "Ox Alpha" הוא למעשה GLM-5.3-Flash משלו, והוא מקיים את ההבטחה הפתוחה שגרמה לקהילה לצפות מקרוב כל השבוע.
עמוד הדגם אסף במהירות יותר מ-1,100 לייקים, והשרשור של האקר ניוז שהכריז על השחרור טיפס מעבר ל-600 נקודות כאשר מפתחים עיכלו את מה שנמצא כעת במאגר ציבורי: 141 קבצי מבטחים, שנשלחו ב-FP8, הכוללים את מה שעשוי להיות מודל הקידוד המסוגל ביותר להורדה פתוחה עד כה. For more context on this story, see our ongoing breaking AI news.
מה Z.ai נשלח בפועל
GLM-5.3 הוא דגם Mixture-of-Experts בנוי על ארכיטקטורה שז.אי מכנה glm_moe_dsa. על פי התצורה שפורסמה לצד המשקולות, הרשת עורמת 78 שכבות עם 256 מומחים מנותבים, ומפעילה 8 מומחים לכל אסימון פלוס מומחה משותף אחד. חלון ההקשר משתרע על 1,048,576 אסימונים - מיליון שלם - והדגם תומך בפרמטר "reasoning_efort" עם הגדרות נמוכות, גבוהות ומקסימליות, ברירת המחדל למקסימום.
אולי ההערה המעניינת ביותר בכרטיס הדגם היא גילוי לב מהיכן הגיעו השיפורים: GLM-5.3 משתמש באותו דגם בסיס כמו GLM-5.2, וכל רווח נובע לאחר האימון. המעבדה מתארת במפורש את התוצאה כ"מודל המשקולות הפתוחות המסוגל ביותר לקידוד".
אמות מידה: SOTA עם משקלים פתוחים על קידוד סוכן
טבלת ההערכה שפורסמה היא נרחבת וספציפית בצורה יוצאת דופן לגבי המתודולוגיה שלה, ומפרטת תוצאות מול Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Opus 4.8 של Anthropic, Fable 5 של גוגל ו-GPT-5.6 Sol של OpenAI.
ב-Terminal Bench 3.0, GLM-5.3 מקבל ציון של 28.3 - קוד פתוח עדכני, וקפיצה מ-4.6 עבור GLM-5.2, אם כי עדיין מאחורי הגבול הסגור של Fable 5 ב-33.7 ו-GPT-5.6 Sol ב-34.6. ב-Terminal Bench 2.1 הוא מציג 88.2, למעשה ברמה של Kimi K3 ו-GPT-5.6 Sol ומקדימה את 85.0 של Opus 4.8. תוצאות DeepSWE זינקו מ-46.2 ל-66.9 בין גרסאות, ו-GLM-5.3 מוביל את הטבלה ב-AutomationBench ב-48.2 וב-GDPval-AA v2 ב-1769, האחרון הוערך על ידי ניתוח מלאכותי.
Z.ai מדווחת גם על שיפור של 50% בהשוואה ל-GLM-5.2 על ספסל הקוד הפנימי שלה, לצד תוצאות פתוחות-משקלות-טובות ביותר במדדים כמו הבחינה האחרונה של הסוכנים.
שאלת יכולת הסייבר
כרטיס הדגם בוטה להפליא לגבי התפתחות שחוקרי בטיחות עוקבים אחריה במשך חודשים: "ככל שהגדלנו את קנה המידה שלאחר האימון, יכולת הסייבר התפתחה מהר יותר ממה שציפינו", נכתב בכרטיס. GLM-5.3 הוא הטכנולוגיה המתקדמת ב-CyberGym לגילוי פגיעות ב-84.5, מקצה כל דגם על השולחן כולל GPT-5.6 Sol, והוא יותר מכפיל את GLM-5.2 במדדים של ניצול - 54.4 לעומת 24.4 ב-ExploitBench, ו-105/1939 לעומת תקציבים של שניים של ExploitBench.
AI Buzz Wire כיסה את היכולות הללו כשהן הופיעו עם מהדורת ה-API בלבד באמצע אוגוסט. מה שמשתנה כעת הוא ההפצה: המשקולות ניתנות להורדה, סביר להניח שבניית קהילה כמותית תגיע במהירות, וכל מי שיש לו מספיק זיכרון יכול להפעיל את המודל באופן מקומי. בדיון ב-Hacker News, חלק מהמשתמשים ציינו כי המודל מרגיש פחות מגביל לגבי משימות סמוכות לאבטחה מאשר חלופות המתארחות בארה"ב - התרשמות קהילתית ולא טענת מדיניות רשמית, אך משקף מדוע גרסה זו נידונה בחוגי האבטחה באותה מידה כמו אלה של מפתחים.
רישיון המיועד ל-Hyperscalers
שלא כמו GLM-5.3-Flash, שנשלח ברישיון MIT נקי, GLM-5.3 מגיע עם "רישיון GLM-5.3" מותאם אישית. ה-New Stack אפיין אותו כמכוון ל-hyperscalers, והטקסט מעיד על כך. עבור כמעט כולם, התנאים למעשה מתירים: שימוש, העתק, שינוי, מיזוג, פרסום, הפצה, רישיון משנה ומכירה, רק עם דרישה לכלול את ההודעה.
החריג מכוון למודל עסקי ספציפי אחד. אם בעל רישיון או השותפים שלו מפעילים עסק של "מודל כשירות" - המציעים לצדדים שלישיים הסקת מסקנות או גישה עדינה - וההכנסה המשולבת שלהם עולה על 10 מיליארד דולר במשך 12 חודשים רצופים, עליהם לעבור סקירת אבטחה Z.ai לפני כל שימוש מסחרי במודל או בנגזרותיו. סעיף זה מצייר מעגל בדיוק סביב ספקי הענן הגדולים ביותר, תוך שהוא משאיר סטארט-אפים, חוקרים, ארגונים ומארחים בקנה מידה בינוני.
הגישה הדו-מסלולית מעידה. גרסת הפלאש, שנחשפת כעת כדגם Ox Alpha שהפך ויראלי לפני ש-TechCrunch חשף את מקורותיו, פועלת כולה על סיליקון סיני ונושאת את דגל ה-MIT לאימוץ מקסימלי. ספינת הדגל מקבלת רישיון בהתאמה אישית ששומר על פריסת Hyperscaler - במיוחד על ידי עננים אמריקאים - מאחורי תהליך הבדיקה של Z.ai עצמו.
להפעיל את זה בעצמך
למי שנוטה לנסות, כרטיס הדגם מפרט תמיכה בפריסה ברחבי vLLM, SGLang, KTransformers, Unsloth ו-Huging Face Transformers, עם מתכוני ספרי בישול עבור כמה מהם. יש לציין, פריסת Huawei Ascend NPU מתועדת באמצעות vLLM-Ascend, xLLM ו-SGLang - ממשיכה בדחיפה של המעבדה להוכיח שדגמי חזית פועלים על חומרה שאינה של Nvidia. בקהילה, DeepInfra הייתה הראשונה להציע נקודת קצה של צד שלישי של המודל הפתוח ב-OpenRouter.
Z.ai גם פרסם דו"ח טכני ב-arXiv, שכותרתו "GLM-5: מ-Vibe Coding to Agentic Engineering", המכסה את הפיתוח של משפחת הדגמים.
למה זה חשוב
המהדורה דוחסת את הפער בין הגבול הסגור לגבול הפתוח לשגיאת עיגול במדדים רבים של קידוד סוכן - שבועות, לא שנים. בשילוב עם Kimi K3 ו-DeepSeek-V4, זה אומר שלמפתחים מחוץ למעבדות הגדולות ביותר יש כעת חלופות אמינות שהם יכולים להחזיק, לבחון ולהתאים.
זה גם מעיד על שינוי באופן שבו מתנהלים מהדורות פתוחות. פיצול הרישיון MIT לעומת מותאם אישית בתוך משפחת דגמים אחת מעיד על כך שמעבדות סיניות לומדות להשתמש ברישוי כתשתית אסטרטגית: פתיחות שבה היא בונה מערכת אקולוגית, מינוף היכן שהיא מגינה על העמדה. המבחן הבא יהיה האם כל מפעיל MaaS בשווי 10 מיליארד דולר אכן יגיש לבדיקת אבטחה Z.ai - או שהסעיף פשוט מרחיק את העננים הגדולים ביותר בזמן שכולם בונים למעלה.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →