Meta telah menarik balik tirai pada MTIA 400, pemecut tersuai pertamanya yang bertujuan tepat untuk melatih model bahasa yang besar — ​​dengan kelainan yang luar biasa. Cip, yang diperincikan minggu ini pada persidangan semikonduktor Hot Chips tahunan, juga akan membawa beban kerja pengesyoran pembelajaran mendalam yang menyediakan iklan yang membiayai keseluruhan cita-cita AI Meta.

The Register, yang pertama kali melaporkan pendedahan teknikal penuh, menggelar reka bentuk itu sebagai "personaliti berpecah": cip latihan sempadan di satu pihak, enjin penyajian iklan di sisi lain. Ia adalah tanda paling jelas bahawa Meta berhasrat untuk menjalankan masa depan AInya pada silikonnya sendiri. Untuk maklumat lanjut tentang perkembangan AI terkini membentuk industri cip, ikuti AI Buzz Wire.

Mengapa Melatih AI dan Menyajikan Iklan pada Cip yang Sama?

Kebanyakan syarikat yang membina pemecut AI tersuai bermula dengan inferens. Kelompok lebih kecil, cip lebih ringkas, dan tugasnya difahami dengan baik. Meta menyokong aliran itu dengan menyasarkan latihan LLM terlebih dahulu — beban kerja yang paling intensif pengiraan dalam industri, selalunya memerlukan berpuluh atau ratusan ribu pemecut.

Kompromi adalah beban kerja kedua. Inferens DLRM — model pengesyoran pembelajaran mendalam yang menentukan iklan dan siaran yang dilihat pengguna — kebanyakannya terikat memori dan bukannya terikat pengiraan, bermakna kebanyakan kuasa tembakan latihan cip tidak berfungsi semasa siaran iklan. Tetapi dengan Meta membakar puluhan bilion dolar semasa pengiraan, mempunyai satu cip tarik dua tugas adalah lindung nilai yang pragmatik, terutamanya apabila salah satu daripada dua kes penggunaan menjana pendapatan secara langsung.

Di dalam MTIA 400: Chiplet 3nm dan IP Broadcom

Menurut persembahan Hot Chips Meta, seperti yang dianalisis oleh The Register dan ServeTheHome:

  • Seni bina berbilang mati: Dua mati pengiraan, dua mati I/O dan satu mati SoC yang mengendalikan ketersambungan hos dan orkestrasi beban kerja
  • Nod proses: Chiplet pengiraan dibina pada teknologi proses 3nm, mungkin daripada TSMC
  • Hitung: Grid 6x8 elemen pemprosesan setiap chiplet, menyampaikan gabungan 12 petaFLOPS pengiraan MXFP4 pada 1.7 GHz
  • Memori: Lapan tindanan 36 GB HBM3e — 288 GB jumlah dengan kira-kira 9.2 TB/s lebar jalur
  • Sambung Sambung: 1.2 TB/s lebar jalur cip-ke-cip melalui RDMA, kemungkinan Ethernet diberikan penglibatan Broadcom

Cap jari Broadcom ada di mana-mana. The Register menyatakan bahawa pemecut hampir pasti dibina menggunakan IP XPU pereka cip — pilihan pragmatik yang membolehkan Meta menumpukan pada pembezaan sambil menyumber luar bahagian reka bentuk pemecut yang tidak menarik.

Bagaimana Ia Bertindih Melawan Nvidia dan AMD

Gambar persembahan adalah bernuansa. Pada ketepatan yang lebih tinggi yang biasa digunakan untuk latihan, MTIA 400 adalah kira-kira 20% lebih pantas daripada pemecut Blackwell spesifikasi teratas Nvidia sambil menarik kuasa yang sama. Jalur lebar memorinya adalah kira-kira 15% lebih baik daripada bahagian generasi sebelumnya Nvidia dan AMD.

Tetapi berbanding generasi terbaharu, jurang melebar dengan ketara: MTIA 400 adalah antara 3x dan 3.3x lebih perlahan daripada Nvidia's Rubin dan AMD's Instinct MI455X, masing-masing, dan ia menawarkan kurang daripada separuh lebar jalur memori bagi GPU baharu tersebut. Defisit itu adalah tepat sebab Meta meletakkan bahagian tersebut sebagai cip latihan dan bukannya cip inferens — untuk menyampaikan token, ia mempunyai pilihan yang lebih pantas.

Pada peringkat sistem, persamaan dengan rak standard industri sangat menarik. Setiap bilah pengiraan memasangkan empat pemecut MTIA 400 dengan suis PCIe, CPU x86 dan NIC skala keluar. Rak penuh memuatkan 18 bilah pengiraan dan lapan bilah suis — 72 pemecut dalam satu domain bersatu, konfigurasi yang mencerminkan reka bentuk rak NVL72 Nvidia dan Helios AMD. Slaid Meta menjanjikan "penskalaan pemecut berbilang ribu" tanpa menyatakan siling kelompok.

Pelan Hala Tuju: MTIA 450 Tahun Depan

MTIA 400 bukanlah penghujung baris. Meta mendedahkan pada bulan Mac bahawa ia merancang kaden keluaran enam bulan merentasi empat generasi MTIA baharu, dan hentian seterusnya ialah MTIA 450 — varian yang dioptimumkan inferens dijangka menggandakan lebar jalur memori, mungkin dengan menggunakan HBM4. Cip itu dijadualkan untuk pengeluaran tahun depan dan sepatutnya sesuai untuk menjalankan beban kerja pengesyoran berasaskan LLM.

Walaupun terdapat kemajuan, analisis The Register adalah tumpul: Silikon dalaman Meta tidak akan menggantikan GPU AMD atau Nvidia dalam masa terdekat. Meta Superintelligence Labs hampir pasti masih melatih model sempadan pada GPU konvensional, dan perkakasan khusus aplikasi kekal paling sesuai untuk beban kerja yang difahami dengan baik dan stabil.

Mengapa Ia Penting

MTIA 400 penting untuk dua sebab. Pertama, ia menunjukkan seorang hyperscaler bersedia untuk menyerang beban kerja yang paling sukar - latihan sempadan - daripada memilih kemenangan inferens mudah. Kedua, bahagian penyajian iklan reka bentuk adalah peringatan ekonomi: setiap dolar belanjawan pada silikon tersuai ditaja jamin oleh perniagaan pengiklanan paling menguntungkan dalam sejarah. Jika Meta boleh mengalihkan walaupun sebahagian kecil daripada latihan dan beban kerja cadangannya daripada GPU pedagang, penjimatan pada skalanya akan diukur dalam berbilion-bilion.

Sumber: Persembahan Meta's Hot Chips 2026, The Register, dan ServeTheHome.

---

Kekal Mendahului AI

Dapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.

Baca lebih banyak berita AI →