xAI פרסמה את Grok 4.6, האיטרציה האחרונה של מודל השפה הגדולה הגבולית שלה, עם ציון 61 במדד האינטליגנציה המלאכותית של ניתוחים כדי להתאים ל-GPT-5.6 Sol של OpenAI. המודל הושק היום וזמין באופן מיידי ב-Cursor ו-Grok Build, עם גישת API ואינטגרציות של שותפים דרך OpenRouter, Vercel ו-Cloudflare.
לחדשות החדשות והניתוחים החדשים של AI, בקר ב-AI Buzz Wire.
מודיעין גבול בשבריר מהעלות
לפי Artificial Analysis, פלטפורמת בנצ'מרק עצמאית, Grok 4.6 צובר חמש נקודות על פני קודמו Grok 4.5 במדד האינטליגנציה, ומחזיר את xAI לשכבת הגבול לצד OpenAI. הדוגמנית יושבת ממש מאחורי קלוד אופוס 5 של אנתרופיק (63) וקלוד פייבל 5 (62), ולפני קימי K3.
מה שהופך את Grok 4.6 לבולט במיוחד הוא התמחור שלו. תמחור הכותרת נותר ללא שינוי מ-Grok 4.5 ב-2$ למיליון אסימוני קלט ו-6$ למיליון אסימוני פלט. זה שם אותו יותר מ-60% מתחת לקלוד אופוס 5 ($5/25$) ו-GPT-5.6 Sol ($5/30$). העלות הנמדדת למשימה היא $0.84, מה שמציב אותה על גבול ה-Intelligence לעומת Cost Pareto.
החזקת תמחור קבוע לאורך דור היא יוצאת דופן בגבול, שם רווחי מודיעין לוו בדרך כלל בעליות מחירים. Grok 4.6 מספק עלייה של חמש נקודות במדד מודיעין בתמחור ללא שינוי.
נבנה עבור סוכנים ותיקים
Grok 4.6 מתבסס על Grok 4.5 עם מה ש-xAI מתאר כהתמקדות מיוחדת בסוכנים ארוכי טווח ובעבודה אינטראקטיבית וויזואלית שאפתנית יותר. החברה אומרת שהמודל נשאר עם משימות מורכבות על פני שלבים רבים, בין אם חקר נושא, ניתוח מידע, עבודה על פני בסיס קוד או הפיכת רעיון ליישום מלוטש.
אמות המידה הסוכן מספרות סיפור משכנע. ב-GDPval-AA v2, מדד מוביל לעבודת ידע סוכן בעולם האמיתי, גרוק 4.6 משיג את ה-Elo של 1753, מאחורי קלוד אופוס 5 בלבד ובאופן סטטיסטי בשווה לקלוד פייבל 5 ו-Qwen3.8 Max. הוא מקבל ציון של 50.7% במדד הבנקאות בקוביות טאו לשירות לקוחות מרובה פניות, וממקם אותו בשני המובילים לצד Qwen3.8 Max.
ב-CursorBench v3.2, Grok 4.6 מקבל ציונים של 69.9%, לפני GPT-5.6 Sol (67.2%) וגם Grok 4.5 (66.7%). הוא מציג 65.9% ב-DeepSWE v1.1 ו-61.3% ב-FrontierCode v1.1 Extended.
יעילות סיבובים יוצאת דופן
אחד הממצאים הבולטים מניתוח מלאכותי הוא פרופיל היעילות של Grok 4.6 ב-AA-Briefcase, אמת מידה פרטית של משימות עבודת ידע אגנטיות לטווח ארוך. הדגם מגיע לראשונה עם Elo של 1577, ומציב אותו בשכבת Fable 5.
מספרי היעילות מדהימים. Grok 4.6 פותר משימות בכ-53 סיבובים ו-0.5 מיליארד אסימוני קלט בממוצע, בהשוואה לכ-103 סיבובים ו-2.0 מיליארד אסימוני קלט עבור קלוד אופוס 5 מקסימום. מכיוון שעבודה סוכנית לטווח ארוך צוברת הקשר במהירות, למודל שמגיע לתשובה דומה בחצי מהסיבובים ורבע מאסימוני הקלט יש יתרון בעלויות הרבה מעבר לתמחור האסימון שלו.
הדרכה ובטיחות
Grok 4.6 עבר ריצת הכשרה משלימה ארוכה יותר מ-Grok 4.5, עם נתונים שנוצרו על ידי מודלים עבור חשיבה ומושגים טכניים מתקדמים, נתונים הנדסיים באיכות גבוהה ומתכון משופר לאופטימיזציה והדרכה. xAI השתמשה ב-Grok 4.5 כדי ליצור מחדש מסלולי SFT על פני מאמצי חשיבה, רתמות סוכנים ודומיינים כולל STEM, הנדסת תוכנה ועבודת ידע.
הדגם נושא חלון הקשר של 500,000 אסימונים, ללא שינוי מ-Grok 4.5. xAI מדווח כי Grok 4.6 עבר את החבילה הרחבה ביותר אי פעם של בדיקות טרום-פריסה ליכולות וכיול הגנה, יחד עם בדיקות מקיפות לאחר הפריסה ובדיקות צד שלישי.
זמינות ותמחור
Grok 4.6 זמין היום ב-Cursor ו-Grok Build. xAI מציעה שימוש כפול כלול בשתי הפלטפורמות במשך השבוע הראשון. התמחור מתחיל ב-$2 למיליון אסימוני קלט ו-6$ למיליון אסימוני פלט, עם גרסה מהירה זמינה במחיר כפול מהמחיר. כניסות מטמון מוזלות ל-$0.50 למיליון אסימונים.
השחרור ממשיך בקצב מהיר עבור xAI, כאשר Grok 4.6 מגיע קצת יותר מחודש לאחר Grok 4.5. המודל מציב את xAI כמתחרה רציני במירוץ הגבולות, במיוחד עבור מפתחים שמעדיפים ביצועים סוכן ויעילות עלות.
הישאר לפני AI
לסיקור רציף של ההתפתחויות החשובות ביותר של תעשיית הבינה המלאכותית, סמן AI Buzz Wire ולעולם אל תחמיצו סיפור שובר.
קרא עוד חדשות AI