Cerebras ו-OpenAI נתנו לעולם הצצה מוקדמת ל-Ultrafast Mode, שכבת שירות חדשה שמושקת לראשונה ב-OpenAI API ומופעלת על ידי חומרת Cerebras. על פי הודעת Cerebras שפורסמה ב-13 באוגוסט 2026, GPT-5.6 Sol הפועל על Ultrafast מספק עד 750 אסימוני פלט לשנייה - ללא פשרות באיכות.

השכבה זמינה תחילה לקבוצה נבחרת של לקוחות, כשהגישה מתרחבת עם הזמן. ההכרזה, שנכתבה על ידי ג'ויס אר של Cerebras, מציבה את ההצעה כפתרון לפשרה שהגדירה את פיתוח מוצרי הבינה המלאכותית במשך שנים: בונים נאלצו לבחור בין מהירות ואינטליגנציה, כי מודלים גדולים וחכמים יותר כרוכים בעלויות חישוב והעברת נתונים גבוהות יותר שמאטות את זמני התגובה. קוראים שעוקבים אחר המירוץ להאצת דגמי הגבול יכולים לעקוב אחר ההתפתחויות האחרונות ב-AI Buzz Wire.

כמה מהיר הוא אולטרה-מהיר, בדיוק?

מספר התפוקה הגולמי בולט בפני עצמו, אבל Cerebras גם סיפק הקשר השוואתי. לפי מהירויות הפלט שדווחו על ידי Artificial Analysis, שירות השוואת ביצועים עצמאי, פועל GPT-5.6 Sol במצב אולטרה-מהיר:

  • מהיר פי 11 מ-Fable 5
  • מהיר פי 5 מאופוס 4.8 במצב מהיר

כדי לבחון את הטענה, Cerebras הריצה את המודל ראש בראש מול מתחרים פופולריים ב-הבחינה האחרונה של האנושות (HLE), אמת מידה מאתגרת המורכבת מ-2,500 שאלות שבדרך כלל ניתן לענות עליהן רק על ידי אנשים בעלי תואר שלישי בתחומים כמו כימיה, כלכלה וספרות.

התוצאה: GPT-5.6 Sol on Ultrafast ענה על כל 2,500 שאלות HLE ב-11 שעות ו-11 דקות. קלוד פייבל 5 נזקק ל78 שעות ו-27 דקות - יותר משלושה ימים של חישוב רציף - כדי להגיע לאותן מסקנות. במילים אחרות, Ultrafast עבדה דרך גבול הידע האנושי ביום עבודה אחד, והשיגה דיוק דומה כמעט פי 7 מהר יותר.

Cerebras ציינה את מתודולוגיית ה-benchmarking שלה: GPT-5.6 Sol Ultrafast נבדק עם Codex על היגיון xhigh ב-10 ביולי, בעוד Claude Fable 5 נבדק עם Claude Code בהיגיון גבוה בין ה-13-15 ביולי.

עומסי עבודה בעולם האמיתי, לא רק בנצ'מרקים

מדדי מהירות יכולים להטעות אם האיכות יורדת לאורך הדרך, וזו הסיבה ש-Cerebras הדגישה גם תוצאות ב-GDP-Val, אמת מידה למשימות עבודת ידע בעלות ערך כלכלי. ב-GDP-Val, Ultrafast סיפקה מהירות של 5.6x מקצה לקצה ללא פגיעה באיכות, על פי בדיקות ש-Cerebras רצה ב-31 ביולי 2026 באמצעות GPT-5.6 Sol ו-GPT-5.6 Sol Ultrafast בהיגיון בינוני בתוך Codex.

החברה טוענת כי GPT-5.6 Sol הוא המודל הטוב ביותר של OpenAI עד כה עבור תדריכים משפטיים, מודלים פיננסיים ודוחות הנדסיים - תחומים שבהם איכות הפלט וזמן האספקה ​​נושאים שניהם השלכות כספיות ישירות.

מדוע מהירות משנה את משוואת הסוכן

השינוי המשמעותי יותר עשוי להיות באופן שבו פועלים סוכני AI. הסקת מסקנות מהירה יותר משנה את מה שאפשרי עבור יחידים וארגונים, מכיוון שניתן להציב סוכנים בנתיב הקריטי של בעיות שבהן כל שנייה חשובה.

"עם GPT-5.6 Sol Ultrafast, Cerebras מאפשרת בינה מלאכותית שעומדת בקצב הדרך שבה אתם חושבים, מקודדים ומשתפים פעולה", אמר רוהן ורמה, מוצר ב-OpenAI, בהצהרה שצוטטה בהודעה. "אנו נרגשים לראות כיצד זרימות עבודה ויישומים משתנים על ידי הסקה מהירה במיוחד."

Cerebras תיאר כמה תרחישים בעלי סיכון גבוה שבהם המהירות חשובה:

תגובה לאירוע

חברות המפעילות שירותי אינטרנט יכולות להשתמש ב-Ultrafast כדי לגרום לשורשים ולטפל בהפסקות ייצור, לשמר את אמון הלקוחות, למנוע אובדן הכנסות ולחסוך דקות השבתה מול ה-SLA שלהן.

אבטחת סייבר

בהתקפות סייבר יריבות עם סיכון גבוה, צוותי אבטחה חייבים לזהות במהירות שחקנים רעים ולהגיב אליהם כדי להכיל הפסדים קטסטרופליים - משימה שבה חביון מסקנות משפיע ישירות על בקרת נזקים.

פרודוקטיביות של סוכן

אולטרה-מהיר מאפשרת מצבי עבודה חדשים עם סוכנים על ידי אספקת תובנות ועדכונים בזמן אמת, ומפחיתה את הצורך במעבר הקשר בין הפעלות מקבילות.

"בעוד שבעבר הייתי צריך לחכות כמה דקות עד שמשימה תסתיים, כעת היא מסתיימת עבורי לפני שבכלל תהיה לי הזדמנות להחליף הקשר. זה עושה אותי הרבה יותר פרודוקטיבי", אמר ג'פרי וואנג, חוקר ב-OpenAI, בהכרזה.

האסטרטגיה שמאחורי השותפות

עבור Cerebras, העסקה מייצגת אבן דרך נוספת במאמץ שלה למסחר האצה בקנה מידה רקיק להסקת AI. עבור OpenAI, מצב אולטרה-מהיר מוסיף דרגת מהירות פרימיום ל-API שלו ברגע שבו זמן השהיית מסקנות הפך למבדיל תחרותי - במיוחד עבור יישומים סוכנים שמשרשרים שיחות דגמים רבות יחד, שבהן כל שיחה מעכבת את המתחם לדקות של המתנה.

החברות ממסגרות את השכבה כנקודת יתרון מתמשכת לארגונים המשתמשים ב-frontier AI כדי להגיב במהירות למידע הנכנס, תוך זיווג עיבוד אולטרה-מהיר לעבודה רגישה לזמן עם עיבוד סטנדרטי למשימות סחורות שניתן לבצע במקביל ברקע.

הגישה מתגלגלת בהדרגה. מפתחים מעוניינים יכולים לעקוב אחר התיעוד של OpenAI API עבור זמינות, שכן Cerebras אומר שהגישה תתרחב עם הזמן מקבוצת הלקוחות הנבחרת הראשונית.

הישאר לפני AI

לסיקור נוסף של מירוץ החומרה והתשתית המעצב מחדש את הבינה המלאכותית, הוסף סימניה ל-AI Buzz Wire ועקוב אחר הפיד של חדשות AI החומרה שלנו.

קרא עוד חדשות AI →