AMD ו-Cerebras Systems חשפו שותפות טכנית לבניית סוג חדש של תשתית AI בינה מלאכותית, המשלבת את פלטפורמת Helios בקנה מידה של AMD עם Wafer-Scale Engine (WSE) של Cerebras בזרימת עבודה אחת ומפורקת. הוכרז באירוע Advancing AI 2026 של AMD ב-23 ביולי 2026, שיתוף הפעולה מכוון ישירות לצווארי הבקבוק של חביון ותפוקה שהפכו את ההסקה לאחת הבעיות היקרות ביותר בעידן ה-AI הגנרטיבי. לקבלת העדכונים האחרונים על הפינה המהירה הזו של התעשייה, עקוב אחר הסיקור חדשות הבינה המלאכותית שלנו.

הרעיון המרכזי הוא להפסיק להכריח שבב אחד לעשות הכל. בערימת מסקנות מסורתית, משפחת GPU יחידה מטפלת הן בעבודת המילוי המוקדמת הכבדה של עיכול הנחיה והן בעבודה העדינה והרציפה של יצירת כל אסימון חדש. זו פשרה, כי לשתי המשרות יש דרישות שונות מאוד. AMD ו-Cerebras טוענות שפיצול העבודה, טכניקה המכונה הסקה מפורקת, מאפשרת לכל מנוע לעשות את מה שהוא הכי טוב בו.

איך שני המנועים מחלקים את העבודה

על פי ההכרזה הרשמית של AMD, AMD Helios תשמש כמנוע התפוקה בעל הביצועים הגבוהים, הניתן להרחבה, תוך שימוש במעבדי AMD Instinct GPU לעיבוד מהיר של קבוצות גדולות של קלט. בינתיים, מנוע ה-Cerebras Wafer-Scale יתמודד עם פענוח ויצירת אסימונים מהירים במיוחד, בהשהייה נמוכה במיוחד. השבבים של Cerebras בנויים על פרוסות שלמות במקום לחתוך לקוביות בודדות, מה שמעניק להם רוחב פס עצום של זיכרון על-שבב שמתאים במיוחד להזרמת אסימונים מבלי להיעצר.

החברות אומרות כי על ידי שילוב של שני מנועי המחשוב, הפתרון המשותף צפוי לספק עד פי 5 אסימונים גבוהים יותר לשנייה לוואט, מדד שהפך לכרטיס ניקוד מרכזי לכלכלת מסקנות, שכן הספקים מתחרים הן על עלויות המהירות והן על עלויות האנרגיה. הנתון צוטט בהודעה לעיתונות של AMD ודווח בכל נקודות מכירה כולל Tom's Hardware, Investing.com ו-Yahoo Tech.

ירייה על הדומיננטיות של Nvidia

השותפות היא גם אות אסטרטגי. מערך ה-CUDA וה-GPU של Nvidia שולטים כיום באימוני AI והסקת מסקנות, והמתמודדים הגיעו למסקנה יותר ויותר שקשה לנצח את המנהיג המכהן בארכיטקטורה אחת. Business Insider הגדיר את העסקה כש-AMD ניצחה את Nvidia על ידי הימור על מסקנות, השלב של מחשוב הבינה המלאכותית שצפוי לגדול הכי מהר ככל שהדגמים עוברים מפיתוח לייצור.

עבור AMD, התאמה עם Cerebras מרחיבה את כוח המשיכה של מפת הדרכים של Instinc and Helios שלה מעבר לאימון. עבור Cerebras, שנסחרת בנאסד"ק תחת הטיקר CBRS לצד AMD (NASDAQ: AMD), שילוב עם ספק מאיץ גדול נותן לטכנולוגיה שלה בקנה מידה רקיק נתיב ברור יותר לפריסות ארגוניות וענן גדולות. Cerebras מתכננת לפרוס את AMD Helios במרכזי הנתונים שלה, והחברות מצפות שהפתרון המשותף יהיה זמין תחילה דרך Cerebras Cloud במחצית השנייה של 2026.

למה הפירוק חשוב עכשיו

עלויות מסקנות הפכו לנקודת לחץ מכוננת עבור תעשיית הבינה המלאכותית. ככל שהמודלים גדלים ויישומים דורשים תגובות בזמן אמת, העלות של יצירת כל אסימון, וההשהיה שמשתמשים חווים בהמתנה לו, יכולים לקבוע אם מוצר בר-קיימא. מסקנות מפורקות מתייחסות למילוי מראש ולפענוח כעומסי עבודה נפרדים שניתן לנתב לחומרה המתאימה ביותר לכל אחד מהם, פילוסופיית עיצוב שחברות כמו Cerebras דוגלות בה במשך יותר משנה.

ההכרזה של AMD-Cerebras מציעה שהגישה עוברת מרעיון מתקומם לארכיטקטורה שאושרה על ידי התעשייה. על ידי שילוב של מומחה תפוקה עם מומחה חביון, שתי החברות מהמרות שעתיד ההסקה אינו שבב אחד שישלוט בכולם, אלא מערכת מתואמת של מנועים מיוחדים.

במה לצפות

נותרו מספר שאלות. הנתון של פי 5 האסימונים לשנייה לוואט הוא ציפייה ולא אמת מידה של צד שלישי, והביצועים בעולם האמיתי יהיו תלויים בדגמים ובעומסי העבודה הספציפיים שהלקוחות מריצים. פרטי תמחור וזמינות מעבר להשקת Cerebras Cloud לא נחשפו, ולא ברור מתי הפתרון עשוי להגיע לספקי ענן אחרים.

עם זאת, העסקה מדגישה שינוי רחב יותר בחומרת הבינה המלאכותית: ההנחה שארכיטקטורת GPU אחת תשרת כל שלב בצנרת הבינה המלאכותית מתקלקלת. אם AMD ו-Cerebras יוכלו לעמוד בטענות היעילות שלהן, מסקנות מפורקות עשויות להפוך לחלק סטנדרטי מהאופן שבו מערכות ה-AI הגדולות ביותר בנויות.

הישאר לפני AI

נוף החומרה של AI מתפצל למחנות מיוחדים, וההשלכות על עלות, מהירות ותחרות הן עצומות. קרא עוד חדשות בינה מלאכותית ב-AI Buzz Wire כדי להתעדכן בכל עסקה גדולה, מהדורה וברנצ'מרק.