OpenAI wis nerbitake asil benchmark pisanan kanggo Jalapeño, chip inferensi khusus, lan nomer sing nggumunake: ing benchmark InferenceX SemiAnalysis, silikon anyar ndhaptar token luwih akeh saben pangguna lan luwih akeh per kilowatt tinimbang prosesor inferensi canggih sing kasedhiya saiki - perbandingan sing kalebu sistem Blackwell Nvidia. Asil padha presented ana ing konferensi Kripik Panas ing Palo Alto, kajawi tampilan technical rinci carane chip iki dibangun. Kanggo maca sing nglacak balapan komputasi sing ndhukung saben rilis model AI, iki minangka salah sawijining titik data hardware sing paling penting ing taun iki.
"Intine yaiku asil kasebut nuduhake kemajuan kinerja sing signifikan banget tinimbang negara seni," ujare Richard Ho, kepala hardware OpenAI, ing telpon pers sing dilaporake dening TechCrunch. "Jalapeño bisa nglayani luwih akeh karya AI saben unit daya, nalika uga ngasilake respon kanthi luwih cepet. Iku efisien banget kanggo nglayani akeh pelanggan, nanging bisa uga latensi banget."
Chip Dibangun kanggo Pipa Inferensi Lengkap
Jalapeño diumumake ing wulan Juni 2026 minangka silikon khusus OpenAI sing pertama, dikembangake kanthi kolaborasi cedhak karo Broadcom, kanthi model AI OpenAI dhewe sing mbantu proses pangembangan chip kasebut. Kemitraan kasebut dhewe wiwit Oktober 2025, nalika OpenAI nggawe rencana kanggo program akselerator khusus multigenerasi bebarengan karo raksasa jaringan.
Sing nggawe Jalapeño beda karo GPU tujuan umum, miturut OpenAI, yaiku dirancang kanthi konser karo model sing bakal ditindakake. Amarga perusahaan ngontrol tumpukan lengkap - produk, model, chip, lan memori AI - para insinyur bisa nyerang fase tartamtu saka proses inferensi sing asring nyebabake gesekan.
Utamane, Jalapeño dirancang kanggo nyilikake wektu tundha sajrone proses praisi lan komunikasi, sing diarani OpenAI asring dadi kemacetan nalika ngladeni model basa gedhe kanthi skala.
"Kita ngrancang Jalapeño kanggo nyilikake gerakan data lan penundaan komunikasi," perusahaan kasebut nulis ing postingan blog sing nuduhake asil. "Iki tegese negara model, kalebu cache KV sing digunakake nalika ngasilake respon, bisa dilebokake kanthi jelas lan tetep lokal nalika sistem ngaktifake kombinasi komputasi, memori, lan jaringan sing tepat kanggo saben fase inferensi."
Titik pungkasan kasebut penting kanggo sapa wae sing nindakake beban kerja AI produksi. KV cache - konteks akumulasi model nalika ngasilake respon - minangka salah siji saka memori paling gedhe lan ngelu bandwidth ing inferensi modern. Tetep lokal lan dikelola kanthi jelas, tinimbang ngacak ing kluster, minangka cara klasik kanggo ngunggahake latensi lan kekuwatan.
Better Than Blackwell — Kanggo Saiki
Perbandingan judhul nglawan sistem Nvidia Blackwell, sing saiki dadi tenaga kerja inferensi AI perbatasan. Analisis independen diterbitake ing dina sing padha dening SemiAnalysis, kanthi judhul "OpenAI Jalapeño: Luwih apik tinimbang Nvidia Blackwell," entuk kesimpulan sing padha babagan asil awal chip kasebut, lan crita kasebut kanthi cepet dadi salah sawijining item sing paling dibahas ing Hacker News.
Nanging eksekutif lan analis OpenAI padha ngati-ati. Ho ngira yen Jalapeño bakal nyebar ing pungkasan taun 2026 "ing volume sing cilik banget," kanthi penyebaran sing luwih penting bakal teka ing 2027. Nalika Jalapeño tekan skala lengkap, kompetisi bisa uga maju kanthi signifikan - peta dalan Nvidia terus maju, lan hyperscaler liyane kalebu Google, Amazon, lan Microsoft kabeh nyurung silikon khusus dhewe.
Minangka TechCrunch nyathet, pathokan sing diukur karo negara jaman saiki minangka gambar, dudu jaminan. Kripik sing menang kanthi efisiensi ing taun 2026 kudu terus menang nglawan apa wae Nvidia lan pesainge taun ngarep.
Napa OpenAI Nggawe Silikon Dhewe
Logika strategis langsung: inferensi minangka biaya ambalan paling gedhe ing OpenAI. Saben pitakon ChatGPT, saben panggilan API, lan saben tugas agen diobong, lan nyewa komputasi kasebut saka Nvidia kanthi rega pasar nyuda wates minangka skala panggunaan. Chip khusus sing disetel kanggo model OpenAI dhewe - dirancang bebarengan karo Broadcom lan dibentuk dening model OpenAI dhewe - menehi perusahaan cara kanggo nglayani luwih akeh pangguna saben watt lan saben dolar.
Jalapeño uga direncanakake minangka platform multigenerasi tinimbang bagean siji-siji. OpenAI ujar manawa arep ngembangake produk, model, chip, lan memori AI bebarengan, supaya saben generasi silikon dioptimalake bebarengan karo model sing bakal ditindakake. Yen asil generasi pisanan terus ing produksi, Jalapeño dadi cithakan kanggo kabeh sing nderek.
Totoan ngluwihi OpenAI. Dominasi Nvidia saka akselerator AI wis dadi bottleneck sing paling ketat ing industri sajrone telung taun, lan saben alternatif sing bisa dipercaya - apa saka tim TPU Google, Amazon, utawa saiki OpenAI - ngganti lanskap negosiasi kanggo kabeh wong sing mbangun infrastruktur AI. Nvidia dhewe dilaporake ngelingake para pelanggan babagan kenaikan rega 15 persen utawa luwih ing server AI amarga biaya memori mundhak, sing mung nambah daya tarik alternatif ing omah.
Apa Sabanjure
Saiki, Jalapeño tetep dadi bagean pra-produksi kanthi nomer kertas sing njanjeni. Tes nyata teka ing pungkasan taun 2026, nalika volume cilik pisanan disebarake, lan utamane ing taun 2027, nalika OpenAI ngarepake skala sing migunani. Pitakonan utama tetep ora dijawab: linuwih ing jagad nyata ing skala pusat data, total biaya kepemilikan versus kapasitas Blackwell sing disewakake, lan apa pinggiran efisiensi bisa tahan marang generasi sabanjure Nvidia.
Isih, pathokan pisanan nandhani tonggak sejarah: sepisanan salah sawijining laboratorium AI gedhe wis nuduhake umum silikon inferensi khusus sing katon bisa ngalahake efisiensi sing paling apik. Kanggo industri sing nganggep pasokan Nvidia minangka garis urip strategis, iki minangka titik infleksi sing asli.
---
Tetep Ahead of AIEntuk warta, analisis, lan terobosan AI paling anyar - kabeh ing sak panggonan.
Waca liyane AI warta →