OpenAI telah melancarkan pemproses inferens tersuai pertamanya, sebuah cip bernama Jalapeño yang direka dan dihasilkan dengan kerjasama Broadcom. Pengumuman itu menandakan langkah paling penting pembuat ChatGPT ke arah memiliki timbunan perkakasan penuh di sebalik perkhidmatan AInya, dan ia meningkatkan tekanan persaingan ke atas Nvidia, yang GPUnya pada masa ini menguasai kebanyakan penggunaan model bahasa yang besar.

Didedahkan pada 24 Jun 2026, pemproses itu direka khusus untuk permintaan sistem inferens OpenAI — proses menjalankan model AI terlatih sebagai tindak balas kepada permintaan pengguna. Menurut TechCrunch, yang melaporkan pelancaran itu, syarikat itu berkata bahawa model AInya sendiri turut membantu dalam pembangunan cip itu. Walaupun Jalapeño masih diuji, OpenAI mendakwa keputusan awal menunjukkan prestasi per watt yang jauh lebih baik daripada alternatif terkini yang terkini. For more context on this story, see our ongoing AI industry coverage.

Cip Dibina untuk Inferens, Bukan Latihan

Perbezaan antara latihan dan inferens adalah penting untuk memahami sebab OpenAI membina Jalapeño. Melatih model sempadan — proses berbulan-bulan, intensif pengiraan untuk mengajar rangkaian saraf dari awal — akan terus bergantung pada perkakasan Nvidia. Inferens, sebaliknya, berlaku setiap kali pengguna menghantar gesaan, dan ia menyumbang sebahagian besar daripada kos yang berterusan untuk menjalankan perkhidmatan seperti ChatGPT.

Dalam pengumumannya, OpenAI menekankan kos operasi cip yang rendah apabila menjalankan model pengekodan masa nyata, jenis beban kerja ejen yang telah ia lakukan melalui produk seperti Codex. TechCrunch melaporkan bahawa walaupun pengurangan sederhana dalam kos inferens boleh meningkatkan ekonomi syarikat secara bermakna, memandangkan jumlah permintaan yang besar yang dikendalikan platformnya setiap hari.

Perkongsian reka bentuk dengan Broadcom diumumkan secara rasmi pada Oktober 2025, walaupun cita-cita silikon OpenAI telah dikhabarkan lebih lama. Reuters, Bloomberg, CNBC, dan Wall Street Journal semuanya secara bebas mengesahkan pelancaran 24 Jun, menandakan keluasan perhatian industri yang diperintahkan oleh pelancaran itu.

Taruhan Timbunan Penuh

OpenAI merangka Jalapeño sebagai sebahagian daripada strategi yang lebih luas untuk mengawal setiap lapisan infrastrukturnya. Syarikat itu menulis bahawa ia "bukan sahaja membangunkan model sempadan atau membina produk di atasnya; ia mereka bentuk infrastruktur di bawahnya: seni bina cip, kernel, sistem memori, rangkaian, penjadualan, sistem penggunaan dan pengalaman produk."

Presiden OpenAI Greg Brockman menjelaskan rasional syarikat pada podcast dalaman sejurus selepas perkongsian Broadcom pertama kali didedahkan. "Kami mempunyai pemahaman yang mendalam tentang beban kerja, " kata Brockman. "Kami benar-benar sedang mencari beban kerja khusus yang kurang diberi perhatian, [dan bertanya] bagaimana kami boleh membina sesuatu yang akan dapat mempercepatkan apa yang mungkin?"

Oleh kerana OpenAI beroperasi merentasi keseluruhan timbunan, ia berpendapat, setiap lapisan boleh dioptimumkan ke arah satu matlamat: menjadikan modelnya lebih pantas, lebih dipercayai dan lebih berpatutan untuk pengguna.

Menyertai Google dan Amazon dalam Custom Silicon

OpenAI bukanlah syarikat AI pertama yang membina pemecutnya sendiri. Google telah lama mereka bentuk Unit Pemprosesan Tensor (TPU) untuk menyediakan modelnya, manakala Amazon telah membangunkan cip Trainium dan Inferentia untuk pelanggan AWS. Apa yang dipanggil pemecut AI ini ditala silikon khusus untuk mempercepatkan beban kerja pembelajaran mesin, dan ia telah menjadi keperluan kompetitif untuk mana-mana hyperscaler yang beroperasi pada skala OpenAI.

Motivasinya adalah mudah: GPU tujuan umum daripada Nvidia berkuasa tetapi mahal, dan mereka mengikat pengendali kepada pembekal tunggal yang harga dan ketersediaannya boleh mengekang pertumbuhan. Cip inferens tersuai memberikan OpenAI lebih kawalan ke atas kos, bekalan dan prestasi untuk beban kerja yang paling penting kepada garis bawahnya.

Perkara yang Kekal pada Nvidia

Ia akan menjadi satu kesilapan untuk membaca Jalapeño sebagai rehat lengkap dari Nvidia. Tugasan yang paling intensif prestasi dalam saluran paip AI — terutamanya pra-latihan model sempadan — masih menuntut jenis pemprosesan mentah dan tujuan umum yang diungguli oleh GPU Nvidia, dan OpenAI kekal sebagai pelanggan utama Nvidia. Jalapeño sebaliknya menyasarkan beban kerja inferens yang lebih sempit tetapi besar, di mana cip yang dibina khas boleh memberikan penjimatan yang terlalu besar.

Tumpuan sempit itu juga yang menjadikan cip itu boleh dipercayai. Daripada cuba menggantikan Nvidia secara menyeluruh, OpenAI hanya bersaing di mana ia percaya pengetahuan mendalam tentang beban kerjanya sendiri memberikan kelebihan — logik yang sama yang mendorong Google dan Amazon untuk membina pemecut khusus di tempat pertama.

Anjakan dalam Landskap Semikonduktor

Pelancaran tiba di tengah-tengah rombakan landskap semikonduktor AI yang lebih meluas. Gergasi cip memori SK Hynix telah memfailkan anggaran $29 bilion penyenaraian AS untuk memanfaatkan permintaan yang meningkat untuk memori AI, manakala syarikat dari Amazon ke Qualcomm telah berlumba-lumba untuk membina atau memperoleh silikon tersuai. Kemasukan OpenAI ke dalam reka bentuk cip menambah satu lagi pesaing yang dibiayai dengan baik ke pasaran yang telah dikuasai Nvidia.

Buat masa ini, Jalapeño kekal dalam ujian, dan OpenAI tidak mendedahkan penanda aras prestasi terperinci atau garis masa penggunaan. Tetapi isyaratnya jelas: syarikat yang membina ChatGPT kini berhasrat untuk membina perkakasan yang menjalankannya, dan ia sanggup membelanjakan berbilion-bilion untuk berbuat demikian.

Sama ada Jalapeño memenuhi janji prestasi per watt awalnya akan menentukan berapa banyak leverage keuntungan OpenAI berbanding kosnya — dan berapa banyak pasaran infrastruktur AI akhirnya beralih daripada satu pembuat cip yang dominan.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →