Nvidia telah memberitahu beberapa pelanggan terbesarnya bahawa harga untuk pelayan yang mengandungi cip AInya akan meningkat lebih daripada 15 peratus pada sistem yang dihantar dari awal 2027, menurut Bloomberg - kenaikan harga utama kedua dalam masa kurang setahun, berlapis di atas kenaikan kira-kira 30 peratus merentasi hampir semua rangkaian produk pada bulan Julai.

Amaran, yang disampaikan melalui pengeluar pelayan yang memasang sistem untuk pengendali pusat data yang besar, tiba pada saat yang sukar untuk industri AI: perusahaan sedang bergelut dengan kos pembinaan infrastruktur yang besar, dan pasaran memori — pemacu peningkatan yang dinyatakan — tidak menunjukkan tanda-tanda penyejukan. Nvidia dijadualkan melaporkan keputusan suku tahunan pada 26 Ogos, di mana penganalisis menjangkakan perincian baharu mengenai permintaan, bekalan dan kos. For more context on this story, see our ongoing artificial intelligence updates.

Sistem mana yang terjejas

Menurut laporan itu, peningkatan itu akan digunakan untuk pelayan yang dibina di sekitar platform Grace Blackwell perdana Nvidia dan generasi Vera Rubin yang akan datang. Kenaikan tidak akan seragam: saiz pelarasan bergantung pada penjanaan silikon Nvidia yang terlibat dan jumlah serta konfigurasi memori dalam setiap sistem.

Pengeluar pelayan yang berkhidmat dengan syarikat teknologi utama — termasuk Microsoft, Google dan Oracle — dilaporkan telah mula memberitahu pelanggan tentang perubahan harga yang akan datang untuk penghantaran sistem pada awal 2027.

Memori adalah puncanya

Pemacu utama ialah kos memori yang meningkat. Sistem AI berprestasi tinggi memerlukan kuantiti memori lebar jalur tinggi yang besar, dan permintaan daripada pengembangan pusat data telah menghantar harga untuk pendakian HBM dan LPDDR5. Pengeluar memori Samsung Electronics, SK Hynix dan Teknologi Micron semuanya menghadapi permintaan yang kukuh kerana kapasiti semikonduktor semakin ditujukan kepada memori lebar jalur tinggi dan produk pengkomputeran lanjutan yang lain.

Gaurav Gupta, naib presiden dan penganalisis di Gartner, berkata peningkatan itu mencerminkan tekanan di seluruh rantaian bekalan AI, bukan hanya RAM. "Harga memori akan meningkat, terutamanya HBM dan LPDDR5, tetapi terdapat aspek lain, seperti wafer faundri termaju, pembungkusan termaju dan kekurangan komponen lain," katanya kepada CIO.com, sambil menambah bahawa isu tersebut menjana masa petunjuk yang lebih lama, "yang biasanya diterjemahkan kepada harga yang lebih tinggi."

Dan dia tidak mengharapkan kelegaan tidak lama lagi. "Dalam persekitaran semasa permintaan yang kukuh dan bekalan terhad, kami menjangkakan keadaan ini berterusan dalam tempoh terdekat hingga pertengahan," kata Gupta — bermakna kos yang lebih tinggi untuk organisasi yang menggunakan pelayan mereka sendiri dan untuk mereka yang menyewa pengiraan dalam awan.

Sedikit pilihan untuk pembeli

Untuk CIO, kalkulus tidak menarik. Perunding dan penganalisis berkata perusahaan mempunyai sedikit pilihan selain menerima bahawa harga infrastruktur AI akan terus meningkat, dan menukar pembekal - walaupun boleh - tidak akan mengetepikan kenaikan itu, kerana kos memori dan komponen menjejaskan keseluruhan pasaran.

Scott Bickley, rakan penasihat di Kumpulan Penyelidikan Info-Tech, berhujah bahawa Nvidia sebenarnya menyerap sebahagian daripada tamparan itu. Pengiraan beliau mencadangkan syarikat itu mungkin memakan sebahagian daripada kosnya yang semakin meningkat dan hanya menyerahkan sebahagian kecil kepada pelanggan terbesarnya. Tetapi dia berterus terang tentang leveraj pembeli: "Kos beban kerja menurun setiap token manakala kos perkakasan dan infrastruktur asas meningkat," katanya. "Jika anda secara langsung membina kluster anda sendiri, ini adalah peningkatan automatik kepada penyelesaian yang sudah sangat mahal. Jika anda membeli perkakasan anda sendiri, anda perlu menyedutnya. Anda tidak akan berunding cara anda keluar dari ini."

Terdapat satu perkara yang digariskan oleh Bickley: harga per-token untuk model AI nampaknya menurun, yang memberikan pembeli cara untuk meredakan inflasi perkakasan dengan mereka bentuk beban kerja yang kurang bergantung pada kapasiti memori mentah.

Memerah lebih daripada apa yang anda sudah miliki

Strategi itu - mendapatkan lebih banyak perbatuan daripada perkakasan sedia ada - adalah tempat beberapa penganalisis berkumpul. Bickley menunjuk kepada teknik seperti penghalaan model, pemampatan dan pemprosesan kelompok sebagai cara untuk meningkatkan penggunaan kluster yang sudah dalam perkhidmatan.

Flavio Villanustre, CISO untuk Kumpulan Penyelesaian Risiko LexisNexis, bersetuju bahawa tekanan itu pada asasnya adalah masalah bekalan-dan-permintaan yang sepatutnya meningkat apabila pengeluaran memori meningkat untuk memenuhi permintaan yang didorong oleh AI — tetapi dia tidak melihat perkara itu berlaku dalam beberapa bulan akan datang. Dalam pada itu, beliau menyatakan, beberapa vendor model AI sedang menyesuaikan model mereka untuk berjalan lebih baik dalam persekitaran terhad memori. Dia menunjuk kepada Gemma E4B Google dan model serupa, yang menggunakan pendekatan bertingkat hierarki yang menarik hanya bahagian yang diperlukan model ke dalam ingatan dan bukannya memegang keseluruhan model dalam RAM.

Mike Wilkes, CISO perusahaan di Aikido Security, berhujah kenaikan harga boleh membawa kebaikan jika mereka memaksa seni bina yang lebih berdisiplin. Perusahaan telah menghabiskan beberapa tahun kebelakangan ini menganggap token model sempadan sebagai "utiliti anjal tak terhingga," katanya — menghalakan beban kerja ke model terbesar tanpa mengira sama ada tugas itu memerlukan penaakulan peringkat sempadan. Seni bina yang betul semakin hibrid: menempah kira-kira 10 peratus penggunaan untuk model sempadan bagi masalah yang benar-benar memerlukannya, sambil mendorong klasifikasi, pengekstrakan, ringkasan dan tindakan ejen rutin ke arah model bahasa kecil dan model berat terbuka yang dijalankan pada infrastruktur yang dikawal oleh perusahaan.

"Itu memberikan leverage CIO terhadap penetapan harga atau penetapan harga unilateral," kata Wilkes.

Isyarat inflasi untuk ekonomi AI

Peningkatan ini juga merupakan isyarat tentang ke mana arah kos ledakan AI. Apabila ingatan, wafer dan pembungkusan semuanya meningkat dalam harga, inflasi merebak daripada pembuat cip kepada vendor pelayan kepada penyedia awan dan akhirnya kepada perusahaan yang membina AI. Dengan laporan pendapatan Nvidia yang akan tamat pada 26 Ogos, pembeli dan pelabur sama-sama akan memerhatikan berapa banyak tekanan kos tersebut yang diserap oleh syarikat — dan berapa banyak ia melepasi hiliran.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →