Startup AI anyar sing diadegake dening mantan peneliti OpenAI wis ngluncurake apa sing diarani model kelas anyar - sing ora bisa nulis esai, lan ujar manawa iki pancen bener.

TypeSafe AI ngumumake dina Selasa ngluncurake "Model Sistem Siji", sing jenenge Jev, kasedhiya langsung ing akses awal. Perusahaan kasebut diadegake dening Diogo Almeida, sing ujar manawa riset ing mburi pandhuane ChatGPT tuwuh saka karya sing disedhiyakake ing OpenAI. Sawise rong taun siluman, dheweke mbantah manawa fiksasi industri ing obrolan wis ora jelas ing ngendi otomatisasi gagal. For more context on this story, see our ongoing more AI stories.

"Model wis dadi manungsa super ing chatting pirang-pirang taun, dadi ing ngendi kabeh otomatisasi?" Almeida nulis ing kiriman peluncuran. "Iki wis dadi pitakonan nyopir sajrone patang taun kepungkur."

Apa Sejatine Model 'System One'

Jeneng kasebut dipinjam saka bedane psikologi antarane pikiran sing cepet, naluriah lan pemikiran sing alon lan disengaja. Ing ngendi model basa gedhe ngasilake token teks kanthi token - fleksibel, umum, lan rawan kanggo omong kosong sing yakin - TypeSafe's Jev dibangun kanggo nindakake sing luwih sempit: njupuk negara sing ora terstruktur minangka input lan bali, keputusan terstruktur kanthi kemungkinan sing dikalibrasi.

Perusahaan nggambarake Jev minangka "telpon fungsi intelijen perbatasan: negara sing ora terstruktur, ngetik keputusan probabilistik." Amarga output sing bisa ditetepake luwih dhisik lan model kasebut ora tau ngasilake strings, TypeSafe ngaku ora bisa ngasilake kesalahan jinis - properti sing dikandhakake perusahaan kasebut dijamin kanthi matematis tinimbang kemungkinan statistik - lan ora bisa halusinasi kanthi cara model ngasilake teks.

Arsitèktur mangkat saka praktik mainstream kanthi telung cara, miturut kiriman peluncuran: arsitektur model anyar, sampler paralel sing ngasilake kabeh output ing pitakonan siji tinimbang kanthi urutan, lan metode latihan sing diarani Reinforcement Learning for Calibrated Decisions (RLCD), sing ngoptimalake kemungkinan sing jujur ​​​​sacara epistemically tinimbang pilihan manungsa utawa output programmatically.

Klaim: 100x Luwih Cepet, Bagean saka Biaya

Nomer sing diterbitake TypeSafe agresif. Perusahaan ujar manawa Jev ngirim intelijen sing bisa dibandhingake karo LLM perbatasan sing ana babagan tugas sing diarani "System One shaped" - klasifikasi, rute, nyetak, ekstraksi lan keputusan cabang - nalika nanggapi ing 70 nganti 500 milidetik, nglawan wektu nanggepi end-to-end 3 nganti 329 detik kanggo model perbatasan. Sing bisa ditindakake 40x nganti 200x luwih cepet, ujare perusahaan.

Regane uga ora konvensional: $0,042 saben yuta token input, kanthi token output gratis, amarga output diitung kanthi paralel tinimbang token sing digawe kanthi token. Perusahaan kasebut ngakoni ing kiriman kasebut yen durung bisa mbuktekake manawa rega kasebut lestari ing skala.

"Klaim sing luar biasa mbutuhake bukti sing luar biasa," tulisan kasebut diwaca, sadurunge menehi bukti apa wae.

The Receipts - lan Apa Skeptics Say

TypeSafe nerbitake demo sisih-by-side mbandingaken Jev marang GPT-5.6 Terra, kang njlèntrèhaké minangka model wates paling iso dibandhingke ing Intelligence padha, lan ngandika mung disagreement ing roto direkam melu telpon pangadilan genuinely ambigu. Uga ngenalake metodologi "eval alur kerja" anyar sing ngukur model nglawan konsensus model eksternal paling gedhe - OpenAI's Astra lan Anthropic's Fable - ing jero grafik komputasi tetep, lan ngaku Jev "nduweni wates Pareto meh 2 pesenan gedhene."

Utamane, perusahaan kasebut nerbitake kiriman kanthi irah-irahan "antibenchmaxxing" sing nerangake sebabe ngindhari pathokan tradisional, kanthi alesan manawa model sing dirancang kanggo keputusan terstruktur ing alur kerja piranti lunak nolak perbandingan global sing migunani.

Reaksi ing Hacker News, ing ngendi peluncuran kasebut narik atusan poin sajrone sawetara jam, saka kasenengan asli nganti skeptisisme sing cetha. Sawetara komentator nyathet yen bukti umum kalebu video demo - kalebu sing nuduhake model sing nguwasani doom gameplay Doom - tinimbang evaluasi pihak katelu sing bisa direproduksi. Wong liya mbantah pendekatan kasebut paling apik dimangerteni minangka klasifikasi kualitas wates sing cepet banget, migunani kanggo sawetara beban kerja tinimbang ngganti LLM.

Malah para pengamat sing simpatik wis nggawe beban bukti kanthi jelas. "Ya, dheweke ngomong minangka skeptis nanging ora menehi bukti akeh, kajaba sawetara video demo," tulis salah sawijining komentator. "A demo urip bakal adoh luwih mestekake."

Kok Bisa Penting Oalah

Pitch ndharat ing titik pain nyata. Sebagéyan gedhé panggilan LLM produksi ing piranti lunak komersial ora generatif - iku pengadilan biner, tugas kategori, lan keputusan rute sing dibungkus prosa. Yen model bisa nelpon kasebut kanthi kapercayan sing dikalibrasi ing 70 milidetik lan biaya output nol kanthi efektif, ekonomi piranti lunak sing didhukung AI bakal owah banget: antarmuka panganggo wektu nyata dadi praktis, lan langkah-langkah pipa sing larang banget kanggo ngotomatisasi karo LLM dadi cukup murah kanggo mbukak ing endi wae.

Kasus panggunaan sing disaranake TypeSafe kalebu klasifikasi lan nuntun data, verifikasi lan njaga output LLM, ndeteksi jailbreak, lan analisa nyuda peta babagan set data gedhe - beban kerja ing ngendi kode lingkungan bisa mbatesi kebebasan model lan nyekel kesalahan.

Perusahaan kasebut jujur ​​​​babagan pitakonan sing mbukak: evals sing diterbitake ditindakake saka laptop ing Pantai Barat AS, lan kelestarian rega jangka panjang tetep ora kabukten. Apa klaim intelijen Jev bisa urip karo tes independen bakal nemtokake manawa "Model Sistem Siji" dadi kategori utawa penasaran.

Akses awal saiki mbukak liwat situs web perusahaan.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →