OpenAI פרסמה את תוצאות הבנצ'מרק הראשונות עבור Jalapeño, את שבב ההסקה המותאם אישית שלה, והמספרים מדהימים: במבחן InferenceX של SemiAnalysis, הסיליקון החדש רשם גם יותר אסימונים למשתמש וגם יותר תפוקה לקילווואט מאשר מעבדי ההסקה המתקדמים הזמינים כיום - השוואה הכוללת את מערכות Blackwell של Nvidia. התוצאות הוצגו ביום שלישי בכנס הוט צ'יפס בפאלו אלטו, לצד מבט טכני מפורט כיצד נבנה השבב. עבור קוראים שעוקבים אחר מרוץ המחשוב שעומד בבסיס כל מהדורת מודל AI, זוהי אחת מנקודות הנתונים החשובות ביותר של החומרה של השנה.

"השורה התחתונה היא שהתוצאות מראות התקדמות מאוד מאוד משמעותית בביצועים על פני הטכנולוגיה", אמר ריצ'רד הו, ראש מחלקת החומרה של OpenAI, בשיחת עיתונאים שדיווחה TechCrunch. "Jalapeño יכול לשרת יותר עבודת בינה מלאכותית ליחידת כוח, ובמקביל גם להחזיר תגובות מהר יותר. זה מאוד יעיל לשרת הרבה לקוחות, אבל זה יכול להיות גם זמן אחזור נמוך מאוד".

שבב שנבנה עבור צינור ההסקה המלא

Jalapeño נחשף ביוני 2026 כסיליקון המותאם אישית הראשון של OpenAI, שפותח בשיתוף פעולה הדוק עם Broadcom, כאשר דגמי ה-AI של OpenAI מסייעים בתהליך הפיתוח של השבב. השותפות עצמה מתחילה באוקטובר 2025, כאשר OpenAI פרסמה תוכניות לתוכנית מאיץ מותאם אישית רב-דורית לצד ענקית הרשתות.

מה שמייחד את Jalapeño מ-GPU לשימוש כללי, לפי OpenAI, הוא שהוא תוכנן בהתאמה לדגמים שהוא ישרת. מכיוון שהחברה שולטת במחסנית המלאה - מוצרי בינה מלאכותית, דגמים, שבבים וזיכרון - המהנדסים שלה הצליחו לתקוף שלבים ספציפיים של תהליך ההסקה שגורמים לרוב לחיכוך.

בפרט, Jalapeño נועד למזער עיכובים בשלבי המילוי המוקדם והתקשורת של העיבוד, שלדברי OpenAI פועלים לעתים קרובות כצווארי בקבוק כאשר מגישים מודלים של שפות גדולות בקנה מידה.

"עיצבנו את Jalapeño כדי למזער את תנועת הנתונים והעיכובים בתקשורת", כתבה החברה בפוסט בבלוג שהציג את התוצאות. "משמעות הדבר היא שמצב המודל, כולל מטמון ה-KV המשמש בעת יצירת תגובה, יכול להיות ממוקם באופן מפורש ולשמור מקומי בזמן שהמערכת מפעילה את השילוב הנכון של מחשוב, זיכרון ורשת עבור כל שלב מסקנות."

הנקודה האחרונה חשובה לכל מי שמפעיל עומסי עבודה של AI בייצור. מטמון ה-KV - ההקשר המצטבר שמודל מחזיק בזמן יצירת תגובה - הוא אחד מכאבי הראש הגדולים של הזיכרון ורוחב הפס בהסקה מודרנית. שמירה על המקום המקומי ומנוהל באופן מפורש, במקום לערבב אותו על פני אשכול, היא דרך קלאסית להחזיר את האחזור והכוח.

יותר טוב מבלקוול - לעת עתה

ההשוואה בכותרת היא מול מערכת Nvidia Blackwell, כיום סוס העבודה של הסקת AI גבולית. ניתוח עצמאי שפורסם באותו יום על ידי SemiAnalysis, שכותרתו "OpenAI Jalapeño: Better than Nvidia Blackwell", הגיע למסקנה דומה לגבי התוצאות המוקדמות של השבב, והסיפור הפך במהרה לאחד הפריטים הנדונים ביותר ב-Hacker News.

אבל מנהלי OpenAI ואנליסטים כאחד מעודדים זהירות. הו העריך ש-Jalapeño יתפרס בסוף 2026 "בנפחים קטנים מאוד", עם פריסה משמעותית יותר שתגיע ב-2027. עד ש-Jalapeño יגיע לקנה מידה מלא, ייתכן שהתחרות התקדמה משמעותית - מפת הדרכים של Nvidia ממשיכה לזוז, ומכשירי היפר-סקאלרים אחרים כולל גוגל, אמזון ומיקרוסופט דוחפים כולם את התאמה אישית משלהם.

כפי ש-TechCrunch ציין, מדדים הנמדדים מול המצב של היום הם תמונת מצב, לא ערובה. שבב שמנצח על יעילות ב-2026 חייב להמשיך לנצח מול כל מה ש-Nvidia ויריבותיה ישלחו בשנה הבאה.

מדוע OpenAI בונה סיליקון משלה

ההיגיון האסטרטגי הוא פשוט: מסקנות היא העלות החוזרת הגדולה ביותר של OpenAI. כל שאילתת ChatGPT, כל קריאת API, וכל משימה סוכן צורבת מחשוב, והשכרת המחשב הזה מ-Nvidia במחירי שוק סוחטת מרווחים כקנה מידה של שימוש. שבב מותאם אישית המכוון לדגמים של OpenAI עצמה - שתוכנן במשותף עם Broadcom ועוצב על ידי הדגמים של OpenAI עצמם - נותן לחברה דרך לשרת יותר משתמשים לוואט ולדולר.

Jalapeño מתוכננת גם כפלטפורמה רב דורית ולא כחלק חד פעמי. OpenAI אמרה שבכוונתה לפתח מוצרי AI, דגמים, שבבים וזיכרון ביחד, כך שכל דור של סיליקון מותאם יחד עם הדגמים שהוא יפעיל. אם תוצאות הדור הראשון מחזיקות מעמד בייצור, Jalapeño הופך לתבנית לכל מה שאחרי.

ההימור משתרע מעבר ל-OpenAI. הדומיננטיות של Nvidia במאיצי בינה מלאכותית הייתה צוואר הבקבוק הדוק ביותר בתעשייה במשך שלוש שנים, וכל חלופה אמינה - בין אם מצוות ה-TPU של גוגל, אמזון או כעת OpenAI - משנה את נוף המשא ומתן עבור כל מי שבונה תשתית בינה מלאכותית. על פי הדיווחים, Nvidia עצמה מזהירה לקוחות מפני עליות מחירים של 15 אחוזים או יותר בשרתי AI עם עליית עלויות הזיכרון, מה שרק מחדד את המשיכה של חלופות פנימיות.

מה שיבוא אחר כך

לעת עתה, Jalapeño נשאר חלק טרום ייצור עם מספרי נייר מבטיחים. המבחן האמיתי מגיע בסוף 2026, כאשר הכרכים הקטנים הראשונים נפרסים, ובמיוחד ב-2027, כאשר OpenAI מצפה להיקף משמעותי. שאלות מפתח נותרו ללא מענה: אמינות בעולם האמיתי בקנה מידה של מרכזי נתונים, עלות בעלות כוללת לעומת קיבולת Blackwell שכורה, והאם יתרון היעילות שורד מול הדור הבא של Nvidia.

ובכל זאת, המדדים הראשונים מציינים אבן דרך: הפעם הראשונה שאחת ממעבדות הבינה המלאכותית הגדולות הדגימה בפומבי סיליקון מסקנות מותאם אישית שנראה כי ניצחה את מיטב היעילות של החברה המכהנת. עבור תעשייה שהתייחסה לאספקת Nvidia כאל חבל הצלה אסטרטגי, זו נקודת פיתול אמיתית.

---

הישאר לפני AI

קבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.

קרא עוד חדשות AI →