Nvidia אמרה לכמה מלקוחותיה הגדולים שהמחירים עבור שרתים המכילים שבבי בינה מלאכותית שלה יעלו ביותר מ-15% במערכות שיסופקו מתחילת 2027, לפי בלומברג - עליית המחירים הגדולה השנייה בתוך פחות משנה, בשכבות על עליות של כ-30% כמעט בכל קווי המוצרים ביולי.
האזהרה, המועברת באמצעות יצרני שרתים שמרכיבים מערכות עבור מפעילי מרכזי נתונים גדולים, נוחתת ברגע עדין עבור תעשיית הבינה המלאכותית: ארגונים נאבקים עם העלות של בניית תשתית מסיבית, ושוק הזיכרון - המניע המוצהר של העלייה - לא מראה סימן להתקררות. Nvidia אמורה לדווח על תוצאות רבעוניות ב-26 באוגוסט, שם האנליסטים מצפים לפרטים חדשים על ביקוש, היצע ועלויות. For more context on this story, see our ongoing AI trends.
אילו מערכות מושפעות
על פי הדיווח, העלייה תחול על שרתים שנבנו סביב פלטפורמות הדגל Grace Blackwell של Nvidia ודור ה-Vera Rubin הקרוב שלה. הטיולים לא יהיו אחידים: גודל ההתאמה תלוי ביצירת הסיליקון של Nvidia המעורב ובכמות ותצורת הזיכרון בכל מערכת.
יצרני שרתים המשרתים חברות טכנולוגיה גדולות - כולל מיקרוסופט, גוגל ואורקל - החלו להודיע ללקוחות על שינויי המחירים הקרובים עבור משלוח מערכות בתחילת 2027.
הזיכרון הוא האשם
המניע העיקרי הוא העלות הגוברת של הזיכרון. מערכות בינה מלאכותית בעלות ביצועים גבוהים דורשות כמויות אדירות של זיכרון ברוחב פס גבוה, והביקוש מהרחבת מרכז הנתונים שלחה מחירים לטיפוס HBM ו-LPDDR5. יצרניות הזכרונות Samsung Electronics, SK Hynix ו-Micron Technology מתמודדות כולן עם ביקוש חזק מכיוון שקיבולת המוליכים למחצה מופנית יותר ויותר לזיכרון ברוחב פס גבוה ומוצרי מחשוב מתקדמים אחרים.
גאורב גופטה, סגן נשיא ואנליסט בגרטנר, אמר שהעליות משקפות לחצים בכל שרשרת האספקה של AI, לא רק RAM. "מחירי הזיכרון עולים, במיוחד HBM ו-LPDDR5, אבל יש היבטים אחרים, כמו פרוסות יציקה מובילות, אריזות מתקדמות ומחסור ברכיבים אחרים", אמר ל-CIO.com, והוסיף כי בעיות אלו מייצרות זמני אספקה ארוכים יותר, "מה שבדרך כלל מתורגם למחירים גבוהים יותר".
והוא לא מצפה להקלה בקרוב. "בסביבה הנוכחית של ביקוש חזק והיצע מוגבל, אנו מצפים שהמצב הזה יימשך בטווח הקרוב לאמצע", אמר גופטה - כלומר עלויות גבוהות יותר הן עבור ארגונים הפורסים שרתים משלהם והן עבור אלה השוכרים מחשוב בענן.
בחירה קטנה עבור קונים
עבור מנהלי מערכות מידע, החשבון אינו מושך. יועצים ואנליסטים אומרים שלארגונים אין ברירה אלא לקבל שתמחור תשתית בינה מלאכותית ימשיך לעלות, והחלפת ספקים - גם אם אפשר - לא תעקוף את העליות, מכיוון שעלויות הזיכרון והרכיבים משפיעות על השוק כולו.
סקוט ביקלי, עמית מייעץ ב-Info-Tech Research Group, טען כי Nvidia למעשה סופגת חלק מהמכה. החישובים שלו מראים שהחברה כנראה אוכלת חלק מהעלויות העולות שלה ותעביר רק חלק קטן ללקוחותיה הגדולים. אבל הוא היה בוטה לגבי המינוף שיש לקונים: "עלות עומס העבודה יורדת לכל אסימון בעוד שעלויות החומרה והתשתית הבסיסיות עולות", אמר. "אם אתה בונה ישירות אשכולות משלך, זו עלייה אוטומטית לפתרון יקר ממילא. אם אתה קונה חומרה משלך, אתה תצטרך לשאוב אותה. אתה לא הולך לנהל משא ומתן על הדרך שלך לצאת מזה."
יש בטנה כסופה אחת שעליה הצביע ביקלי: נראה כי מחירי אסימון עבור דגמי בינה מלאכותית יורדים, מה שנותן לקונים דרך להקהות את אינפלציית החומרה על ידי תכנון עומסי עבודה המסתמכים פחות על קיבולת זיכרון גולמי.
לסחוט יותר ממה שכבר בבעלותך
האסטרטגיה הזו - קבלת קילומטראז' רב יותר מחומרה קיימת - היא המקום שבו מתכנסים כמה אנליסטים. ביקלי הצביע על טכניקות כמו ניתוב מודלים, דחיסה ועיבוד אצווה כדרכים להגביר את הניצול של אשכולות שכבר נמצאים בשירות.
Flavio Villanustre, CISO מקבוצת LexisNexis Risk Solutions, הסכים שהסחיטה היא ביסודה בעיית היצע וביקוש שצריכה להגיע לרמה ברגע שייצור הזיכרון יתגבר כדי לענות על הביקוש מונע בינה מלאכותית - אבל הוא לא רואה את זה קורה בחודשים הקרובים. בינתיים, הוא ציין, כמה ספקי דגמי בינה מלאכותית מתאימים את המודלים שלהם כך שיפעלו טוב יותר בסביבות מוגבלות בזיכרון. הוא הצביע על Gemma E4B ומודלים דומים של גוגל, המשתמשים בגישה מדורגת היררכית שמושכת רק את החלקים הדרושים של המודל לזיכרון במקום להחזיק את כל הדגם ב-RAM.
מייק ווילקס, CISO ארגוני ב-Aikido Security, טען שעליית המחירים יכולה להועיל אם הן מאלצות ארכיטקטורות ממושמעות יותר. ארגונים השקיעו את השנים האחרונות בהתייחסות לאסימוני מודל גבול כאל "כלי עזר אלסטי לאין שיעור", הוא אמר - ניתוב עומסי עבודה למודל הגדול ביותר, ללא קשר לשאלה אם המשימה דורשת היגיון ברמת הגבול. הארכיטקטורה הנכונה הופכת יותר ויותר היברידית: שמירת כ-10 אחוז מהצריכה למודלים חזיתיים לבעיות שבאמת זקוקות להן, תוך דחיפה של סיווג, מיצוי, סיכום ופעולות שגרתיות של סוכנים לעבר מודלים של שפות קטנות ומודלים בעלי משקל פתוח הפועלים על תשתית שהארגון שולט.
"זה נותן למנמ"רים מינוף נגד גזירת מחירים או קביעת מחירים חד צדדית", אמר ווילקס.
אות אינפלציה לכלכלת הבינה המלאכותית
העלייה היא גם איתות לאן מובילות העלויות של תנופת הבינה המלאכותית. ככל שהזיכרון, הפרוסים והאריזה עולים כולם במחיר, האינפלציה מתפשטת מיצרניות השבבים לספקי שרתים לספקי ענן ובסופו של דבר לארגונים שבונים על AI. עם דו"ח הרווחים של Nvidia שייערך ב-26 באוגוסט, קונים ומשקיעים כאחד יצפו כמה מלחץ העלויות הזה החברה סופגת - וכמה הוא עובר במורד הזרם.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →