Nvidia повідомила деяким своїм найбільшим клієнтам, що ціни на сервери, які містять її чіпи ШІ, зростуть більш ніж на 15 відсотків для систем, поставлених з початку 2027 року, згідно з Bloomberg.
Попередження, передане через виробників серверів, які збирають системи для операторів великих центрів обробки даних, припадає на делікатний момент для індустрії штучного інтелекту: підприємства борються з вартістю масштабного будівництва інфраструктури, а ринок пам’яті — заявлений рушійний фактор зростання — не демонструє ознак охолодження. Nvidia планує оприлюднити квартальні результати 26 серпня, де аналітики очікують нових подробиць щодо попиту, пропозиції та вартості. For more context on this story, see our ongoing AI trends.
На які системи це впливає
Згідно зі звітністю, збільшення стосуватиметься серверів, побудованих на основі флагманської платформи Nvidia Grace Blackwell і майбутнього покоління Vera Rubin. Підвищення не буде рівномірним: розмір коригування залежить від покоління процесорів Nvidia, а також від обсягу та конфігурації пам’яті в кожній системі.
Повідомляється, що виробники серверів, які обслуговують великі технологічні компанії, включаючи Microsoft, Google і Oracle, почали сповіщати клієнтів про майбутні зміни цін на системи, що постачаються на початку 2027 року.
Винуватцем є пам'ять
Основним фактором є зростання вартості пам'яті. Високопродуктивні системи штучного інтелекту вимагають величезної кількості пам’яті з високою пропускною здатністю, а попит на розширення центру обробки даних спричинив зростання цін на HBM і LPDDR5. Виробники пам’яті Samsung Electronics, SK Hynix і Micron Technology стикаються з високим попитом, оскільки потужність напівпровідників все більше спрямовується на пам’ять із високою пропускною здатністю та інші передові обчислювальні продукти.
Гаурав Гупта, віце-президент і аналітик Gartner, сказав, що підвищення відображає тиск на весь ланцюжок постачання ШІ, а не лише на оперативну пам’ять. «Ціни на пам’ять зростають, особливо на HBM і LPDDR5, але є й інші аспекти, як-от передові ливарні пластини, вдосконалена упаковка та інші дефіцити компонентів», — сказав він CIO.com, додавши, що ці проблеми призводять до більш тривалого часу виконання, «що зазвичай призводить до вищих цін».
І скорого полегшення він не очікує. «У нинішньому середовищі високого попиту та обмеженої пропозиції ми очікуємо, що така ситуація збережеться в найближчій або середньостроковій перспективі», — сказав Гупта, маючи на увазі вищі витрати як для організацій, які розгортають власні сервери, так і для тих, хто орендує комп’ютери в хмарі.
Невеликий вибір для покупців
Для ІТ-директорів це обчислення непривабливе. Консультанти та аналітики кажуть, що у підприємств немає іншого вибору, окрім як погодитися з тим, що ціни на інфраструктуру штучного інтелекту продовжуватимуть зростати, і зміна постачальника — навіть якщо це можливо — не обійде стороною підвищення, оскільки вартість пам’яті та компонентів впливає на весь ринок.
Скотт Біклі, консультант Info-Tech Research Group, стверджував, що Nvidia фактично поглинає частину удару. Його розрахунки показують, що компанія, ймовірно, поглинає частину власних зростаючих витрат і передає лише частину своїм найбільшим клієнтам. Але він прямо сказав про леверидж, який мають покупці: «Вартість робочого навантаження падає на токен, тоді як базові витрати на обладнання та інфраструктуру зростають», — сказав він. «Якщо ви безпосередньо створюєте власні кластери, це автоматичне підвищення і без того вкрай дорогого рішення. Якщо ви купуєте власне обладнання, вам доведеться його висмоктати. Ви не збираєтеся домовитися про свій вихід із цього».
Є одна перевага, на яку вказав Біклі: ціни за токени для моделей штучного інтелекту, здається, падають, що дає покупцям спосіб притупити інфляцію апаратного забезпечення шляхом проектування робочих навантажень, які менше залежать від необробленої ємності пам’яті.
Витискайте більше з того, що у вас уже є
Кілька аналітиків зійшлися в цій стратегії — отримати більший пробіг від існуючого обладнання. Біклі вказав на такі методи, як маршрутизація моделі, стиснення та пакетна обробка як шляхи підвищення використання кластерів, які вже працюють.
Флавіо Вільянустре, керівник відділу інформаційних технологій у групі ризиків LexisNexis Risk Solutions Group, погодився, що стиснення — це, по суті, проблема попиту та пропозиції, яка має припинитися, коли виробництво пам’яті збільшиться, щоб задовольнити попит, керований штучним інтелектом, але він не бачить, що це станеться в найближчі кілька місяців. Тим часом, зазначив він, деякі постачальники моделей ШІ адаптують свої моделі для кращої роботи в середовищах з обмеженою пам’яттю. Він вказав на Gemma E4B від Google і подібні моделі, які використовують ієрархічний багаторівневий підхід, який завантажує лише необхідні частини моделі в пам’ять, а не зберігає всю модель в оперативній пам’яті.
Майк Вілкс, корпоративний CISO в Aikido Security, стверджував, що підвищення цін може принести користь, якщо воно змусить більш дисципліновану архітектуру. Підприємства протягом останніх кількох років розглядали токени граничної моделі як «нескінченно еластичну утиліту», — сказав він, — маршрутизуючи робочі навантаження до найбільшої моделі незалежно від того, чи потребує завдання міркування на граничному рівні. Правильна архітектура стає все більш гібридною: резервує приблизно 10 відсотків споживання для граничних моделей для проблем, які справді їх потребують, водночас просуваючи класифікацію, вилучення, узагальнення та звичайні дії агентів у бік малих мовних моделей і відкритих моделей, що працюють на інфраструктурі, яку контролює підприємство.
«Це дає ІТ-директорам важіль проти підвищення цін або одностороннього встановлення цін», — сказав Вілкс.
Сигнал інфляції для економіки ШІ
Збільшення також є сигналом про те, куди рухаються витрати на штучний інтелект. Оскільки пам’ять, пластини та упаковка зростають у ціні, інфляція поширюється від виробників мікросхем до постачальників серверів, хмарних провайдерів і, зрештою, до підприємств, які будують на основі ШІ. Оскільки звіт про прибутки Nvidia має бути представлений 26 серпня, покупці та інвестори однаково будуть стежити за тим, який тиск витрат компанія поглинає — і скільки він переходить на спад.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →