מעבדת הבינה המלאכותית הסינית MiniMax נקטה בגישה יוצאת דופן למהדורה האחרונה שלה: היא בקושי הכירה בכך. ב-27 בספטמבר, החשבון הרשמי של החברה אישר את מה שמפתחים כבר הבחינו במוצר - דגם חדש בשם M3.1-Flash-Preview עלה לאוויר בתוך MiniMax Code, עוזר הקידוד של החברה. זה היה היקף ההשקה: ללא כרטיס דגם, ללא טבלת מדד, ללא מחיר למיליון אסימונים.
צופי בינה מלאכותית סינית ב-X הבחינו שהדגם מופיע במוצר לפני האישור, לפי Startup Fortune. ההפעלה המושתקת מהווה ניגוד בולט לאופן שבו MiniMax שלחה את ספינת הדגל האחרונה שלה. For more context on this story, see our ongoing AI news.
הופעת בכורה שקטה בכוונה
כאשר MiniMax השיקה את M3 ביוני, החברה פרסמה פרטי ארכיטקטורה, ציוני SWE-bench וגיליון תמחור שהפחית את היריבות ב-90%. הפעם, נקודת הקצה של ה-API עבור M3.1-Flash-Preview סגורה, והדרך היחידה לנסות את המודל היא בתוך המוצר של MiniMax עצמו, עם עקבות חשיבה והתנהגות כאותות הנצפים העיקריים.
האסטרטגיה הנמוכה מציעה ש-Minimax עשוי להתייחס לגרסה פחות כמו השקת כותרת ויותר כמו ניסוי: A/B בדיקת תכונת מוצר ונותנת לאינטרנט לגלות. זה יכול לשקף ביטחון שהדגם ידבר בעד עצמו ברגע שמפתחים ישתמשו בו - או פשוט שהמהדורה הזו היא לא הגדולה, אלא שכבת נלווית מהירה וזולה יותר.
מה הבסיס M3 אומר לנו
דגם ה-M3 הבסיסי מציע תחושה של מה MiniMax יכול לשלוח כשהוא כן רוצה תשומת לב. זהו מודל של 428 מיליארד פרמטרים של תערובת של מומחים עם כ-23 מיליארד פרמטרים פעילים לכל אסימון, חלון הקשר של מיליון אסימון וקלט תמונה ווידאו מקורית. ב-SWE-bench Verified, MiniMax דיווחה על ציון של 80.5%.
פלאש הוא הגרסה של הקו שנבנה כדי לחדד את היתרון המהירות והמחיר הזה עבור קידוד יומיומי - תיקוני הבאגים המהירים ומפתחי העבודה הקטנים של תכונות פועלות עשרות פעמים ביום, במקום המשימות הסוכנות ארוכות האופק השמורות לספינת הדגל. פיצול קו דגמים בדרך זו, עם גרסת גבול גדולה ומלווה מהיר וזול, הפך לספר המשחקים הסטנדרטי בקרב מעבדות סיניות המתחרות על שיתוף מחשבים למפתחים.
משלוח לשדה צפוף
MiniMax לא משתחררת לשוק שקט. עליבאבא הוציאה את Qwen3.8-Max ב-3 באוגוסט - ספינת דגל של 2.4 טריליון פרמטרים במחיר של 2 דולר למיליון אסימוני קלט - ולאחר מכן הוציאה ב-12 באוגוסט את הגרסה הראשונה במשקל פתוח של דגם Max-tier Qwen. ה-GLM-5.3 של Zhipu נחת ב-14 באוגוסט עם חלון הקשר משלו של מיליון אסימונים.
מפתחים שמו לב למבול של אפשרויות מוכשרות וזולות. על פי הדיווח של CNBC על נתוני OpenRouter, דגמים סיניים היוו 57% עד 67% מסך השימוש באסימונים בפלטפורמה בשבוע שכלל את 14 בספטמבר - עלייה מ-6% בלבד ל-13% בפברואר. ורצל ראתה זינוק דומה, כאשר נתח השימוש של הדגמים הסיניים בפלטפורמה שלה עלה ל-55% באוגוסט.
וושינגטון צופה
הזינוק משך תשומת לב הרבה מעבר לקהילות מפתחים. דניאל רמלר, עמית בכיר בתוכנית הטכנולוגיה והביטחון הלאומי במרכז לביטחון אמריקאי חדש, אמר ל-CNBC כי בינה מלאכותית סינית מייצגת "סיכונים כלכליים וביטחוניים אמיתיים עבור ארצות הברית", והזהירה מפני שילוב מודלים סיניים בתהליכי עבודה קריטיים.
בדיקה זו מוסיפה שכבה של מורכבות למהדורה השקטה של MiniMax. מודל שמגיע ללא כרטיס דגם, הערכות שפורסמו או תמחור נותן למפתחים עצמאיים פחות מה לעבוד איתו בעת הערכת איכות ובטיחות - גם כאשר מוצרי המעבדה זוכים לנתח שימוש אמיתי מול יריבים אמריקאים.
מדוע ההשקה השקטה עשויה להיות אסטרטגית
דגמי תצוגה מקדימה המסודרים בתוך מוצר של חברה עצמה הם דפוס מוכר: הם מייצרים נתוני שימוש ומשוב לפני שחרור API רחב יותר, תוך הגבלת חשיפה אם המודל מתפקד פחות. עבור MiniMax, הופעת הבכורה המושתקת של M3.1-Flash-Preview עשויה להיות גם דרך להחזיק את אור הזרקורים להשקה גדולה יותר - החברה הכפילה את המכירות כשהיא מכינה דגם דגל חדש, על פי דיווח שצוטט על ידי Startup Fortune.
עבור מפתחים, ההנחה המעשית היא פשוטה: שכבת קידוד מהירה חדשה מאחת המעבדות המובילות בסין פעילה כעת בתוך MiniMax Code, ואמות המידה והתמחור שבדרך כלל יסגרו מהדורה כזו עדיין חסרים. האם M3.1-Flash-Preview יכול להרחיב את המומנטום שנשא דגמים סיניים לחלק הארי של תעבורת OpenRouter יהיה תלוי בביצועים שלו ברגע שמפתחים יתחילו לדחוף דרכו עומסי עבודה אמיתיים.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →