Nvidia הכניסה את מאיץ ההסקות האינטראקטיבי Groq 3 LPX שלה לייצור מלא, כך הודיעה החברה ב-24 באוגוסט 2026, במהלך ועידת Hot Chips. השבב, הרחבה של פלטפורמת Vera Rubin של Nvidia, סיפק שיא של 3,400 אסימוני פלט לשנייה בהשוואת ניתוח מלאכותי תוך הפעלת מודל הקוד הפתוח Gemma 4 31B עם חלון הקשר פעיל של 100,000 אסימונים - הביצועים המהירים ביותר שנרשמו אי פעם עבור דגם זה.

ההשקה מסמנת את אבן הדרך המשמעותית ביותר של המוצר עד כה מרכישתה של Nvidia ב-20 מיליארד דולר של מומחה ההסקות Groq, עסקה שהחברה עוברת כעת כדי לנצל את הביקוש להסקת הסקת אחזור נמוכה. CNBC דיווחה כי Nvidia אומרת כי מתלים Groq הראשונים יהיו מקוונים לפני סוף השנה. להקשר נוסף על הסיפור הזה, עיין בסיקור תעשיית הבינה המלאכותית שלנו.

מדוע חשובה מהירות יצירת האסימונים

מערכות בינה מלאכותית - תוכניות שגורמות להיגיון, מתקשרות לכלים, כותבות ובודקות קוד וחוזרות על פני מאות או אלפי שלבי הסקה - מייצרות כמויות אדירות של אסימוני פלט. המהירות שבה מיוצרים האסימונים הללו, המכונה אינטראקטיביות או תפוקת פענוח, קובעת באיזו מהירות סוכן יכול להשלים כל שלב בעבודתו.

Nvidia אומרת ש- Groq 3 LPX מספק תגובה מהירה פי 4 עבור סוכנים ועומסי עבודה רגישים לזמן השהייה מאשר הפלטפורמה החלופית הקרובה ביותר. בפריסות הטרוגניות, מערכות Vera Rubin NVL72 מטפלות בקליעת הקשר ובחישוב קדם מילוי, בעוד שיחידות Groq 3 LPX מעבדות את שלב יצירת האסימונים הרגישים לזמן ההשהיה.

"מסק הוא מנוע הצמיחה של AI", אמר ג'נסן הואנג, מייסד ומנכ"ל Nvidia, בהכרזה. "ורה רובין מרחיבה את החזון הזה עם תצורות מפעל AI המותאמות לעומס עבודה המיועדות לעידן של AI סוכן, ומקדמת את גבול הביצועים עם LPX ליצירת אסימונים מהירים במיוחד."

בתוך החומרה

לפי הניתוח הטכני של StorageReview, כל מגש מחשוב מקורר נוזלי 2U נושא שישה עשר רכיבי Groq 3 LPU לצד מעבד מארח, לוגיקת הרחבת בד ו-DRAM, בתוספת BlueField-4 DPU או כרטיס רשת ConnectX-9. המגש כולל 32 קישורים אופטיים של שבב-לשבב LPU ו-400Gb/s Ethernet בפאנל הקדמי.

בקנה מידה מתלים, פריסת Groq 3 LPX משלבת עד 256 מאיצי LP30 המקושרים באמצעות חיבורים מהירים וישירים שבב לשבב. המתלים נכנסים לתשתית הרחבה יותר של מפעל Vera Rubin AI של Nvidia, שהחברה מתארת ​​כפלטפורמה הנרחבת ביותר שלה אי פעם: שבעה שבבים נפרדים על פני חמש תצורות מתלים ייעודיות, כולל BlueField-4 DPUs, מדפי מעבד Vera, אחסון Vera BlueField-4 STX ורשתות Spectrum-6 SPX Ethernet.

Nvidia גם רעננה את טענות הביצועים שלה ברמת הפלטפורמה, וקבעה ש-Vera Rubin NVL72 מספקת עד פי 30 מהתפוקה האסימון למגה-וואט בהשוואה ל-GB300 NVL72 בעומס עבודה של 140,000 אסימונים של קידוד סוכן, כשהיתרון מתרחב ככל שעולה יעדי האינטראקטיביות לכל משתמש.

אמת מידה עם כוכבית

הכותרת 3,400 אסימונים לשנייה מגיעה עם אזהרה שכדאי לשים לב אליה. כפי שציין StorageReview, התוצאה של Nvidia נמדדה בנקודת קצה פרטית לפני שחרור ב-21 באוגוסט, בעוד שהמספרים המתחרים מולה הושוו הגיעו מנקודות קצה חיות ללא שרת. הביצועים בעולם האמיתי בשירותים הזמינים בדרך כלל עשויים להיות שונים מתצורת הגדרת השיא.

ובכל זאת, ארגון הבנצ'מרקינג העצמאי Artificial Analysis רשם את התוצאה כתוצאה המהירה ביותר שנמדדה אי פעם עבור Gemma 4 31B באורך ההקשר הזה, והטענה הבסיסית - שסיליקון ייעודי יכול להאיץ באופן דרמטי את שלב הפענוח של ההסקה - מתיישבת עם האופן שבו התעשייה נבנתה מחדש עבור עומסי עבודה סוכנים.

מתחיל אימוץ ענן

Nebius, ענן הבינה המלאכותית שבסיסה באמסטרדם, היא הספקית הראשונה שמתחייבת לפרוס את Groq 3 LPX, ומתכננת להכניס אותו ל-Nebius Token Factory, פלטפורמת ההסקת הייצור שלה.

"הדור הוא שלב ההסקה שקובע עד כמה מערכת בינה מלאכותית מגיבה, וזה בדיוק מה ש-NVIDIA Groq 3 LPX בנויה להאיץ", אמרה דנילה שטן, מנהלת הטכנולוגיה הראשית של Nebius. "כענן הבינה המלאכותית הראשון שמביא אותו לייצור דרך Nebius Token Factory, אנו מוודאים שכל שלב בלולאה של סוכן מרגיש מיידי - דרך אותו API שמפתחים כבר משתמשים, ללא מעבר לחסימה חדשה."

ספקית ההסקות Groq, כעת חלק ממשפחת Nvidia, מתכננת להיות בין המאמצים הראשונים של הפלטפורמה.

התמונה הגדולה יותר

ההכרזה על הייצור המלא מסמנת עד כמה שוק תשתיות הבינה המלאכותית הפך בצורה חדה מהדרכה להסקת מסקנות. כאשר ארגונים מעבירים תקציבים מהכשרה מוקדמת של מודלים גולמיים לעבר חשיבה בזמן אמת ותזמור סוכנים אוטונומיים, הכלכלה של אסימון - כמה מהר ניתן לייצר אותו ובאיזה עלות אנרגיה - הפכה לשדה הקרב התחרותי המרכזי.

עבור Nvidia, Groq 3 LPX מרחיב את ההגנה על זיכיון מפעלי הבינה המלאכותית שלה ברגע שבו סיליקון מותאם אישית מספקי ענן וסטארט-אפים כאחד רודף אחרי אותם עומסי עבודה מסקנתיים. מתלים שיגיעו לרשת השנה, כפי שדיווחה CNBC, ישימו את מערכות הייצור הראשונות בידי הלקוחות חודשים לאחר סגירת הרכישה - אינטגרציה מהירה לפי תקני תעשיית המוליכים למחצה.

החברה לא חשפה את תמחור המערכות החדשות. Groq 3 LPX יוצע על בסיס מתי-ואם-זמין באמצעות שותפי ענן בינה מלאכותית, כאשר Nebius צפוי להיות הראשון להציע גישה למפתחים דרך נקודות הקצה הקיימות של ה-API שלה.

---

הישאר לפני AI

קבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.

קרא עוד חדשות AI →