Sakana AI sing berbasis ing Tokyo wis ngluncurake Fugu, sistem sing nyedhiyakake kinerja model AI perbatasan kanthi koordinasi kanthi dinamis akeh model sekaligus. Tinimbang mbangun jaringan saraf raksasa, Fugu dhewe minangka model basa sing dilatih kanggo nelpon LLM liyane saka "kolam agen" sing bisa diganti, ngumpulake tim model khusus kanggo saben tugas lan nyintesis output liwat API sing kompatibel karo OpenAI.
Peluncuran, sing diliputi dening THE DECODER, MarkTechPost, lan MIT Sloan Management Review, nuduhake taruhan yen kabisat sabanjure ing kinerja AI bisa uga kurang saka skala mentah lan luwih akeh saka koordinasi model sing wis ana. For more context on this story, see our ongoing latest AI developments.
Siji Model kanggo Mrentah Kabeh
Kanggo pangguna, Fugu tumindak kaya model tunggal. Ing hood, iku salah siji nangani panjalukan dhewe utawa narik bebarengan tim model khusus, ngatur pilihan, delegasi, mriksa, lan sintesis internal. Sakana AI ujar manawa pendekatan kasebut adhedhasar karya sadurunge kaya ALE-Agent, sing manggonake nomer 21 saka 1,000 ahli manungsa ing kompetisi coding nggunakake teknik orkestrasi.
Perusahaan ngeculake rong varian. Model Fugu dhasar nargetake latensi sing sithik lan kinerja saben dina sing solid ing babagan coding, review kode, lan kasus panggunaan chatbot, lan ngidini tim ngilangi agen tartamtu saka blumbang kanggo privasi utawa kepatuhan. Fugu Ultra dibangun kanggo kualitas jawaban sing maksimal babagan masalah sing rumit lan multi-langkah kayata reproduksi makalah ilmiah, analisis keamanan siber, lan telusuran paten lan literatur.
Pratelan Benchmark Sing Nggawe Kepala
Miturut asil benchmark Sakana AI sing diterbitake, Fugu Ultra nindakake setara karo Anthropic's Fable 5 lan Mythos Preview ing macem-macem coding, penalaran, lan pathokan sains. Utamane, model Anthropic ora ana ing kolam agen Fugu amarga ora kasedhiya kanggo umum, tegese Fugu entuk skor sing padha nggunakake model liyane.
Nomer sing diterbitake striking. Ing SWE-Bench Pro, Fugu Ultra ngetung 73,7, ing ngarep Opus 4.8 ing 69.2, Gemini 3.1 Pro ing 54.2, lan GPT 5.5 ing 58.6. Ing TerminalBench 2.1, skor 80.2 lawan Opus 4.8 82.1. Ing LiveCodeBench tekan 93.2 nglawan GPT 5.5 85.3, lan ing Ujian Terakhir Kemanusiaan dikirim 50.0, sing paling dhuwur ing Opus 4.8 49.8 lan GPT 5.5 41.4.
Tes Donya Nyata Ngecet Gambar Campuran
Ulasan tangan awal kurang antusias tinimbang benchmark. Peneliti AI Ethan Mollick nulis ing X yen Fugu Ultra "alon banget," kanthi tes coding biasanipun njupuk 30 menit lan asil sing "apik" nanging kurang saka Fable ing praktik. Pangguna liyane nglaporake nyebul kabeh kuota limang jam ing rencana $ 20 kanthi pituduh siji, nalika pangembang ing Hacker News ngeluh manawa rencana $ 200 saben wulan ngasilake kurang saka telung jam seminggu wektu sing bisa digunakake.
Tinjauan kode muncul minangka titik sing padhang, kira-kira cocog karo kualitas Opus 4.8 utawa GPT 5.5. Siji tes head-to-head nuduhake Fugu Ultra ngrampungake tugas coding sajrone 22 menit kanthi rega $7.32, luwih cepet lan luwih murah tinimbang Opus 4.8 79 menit lan $37.85, sanajan reviewer luwih milih output Opus.
Sakana AI, didegaké ing Tokyo ing taun 2023 lan didhukung dening Nvidia, wis mbangun identitas ing riset AI sing diilhami alam, nggunakake algoritma evolusi lan gagasan intelijen kolektif kanggo nyepetake kinerja luwih saka model sing wis ana. Fugu ngluwihi filosofi kasebut menyang pasar komersial, ngowahi orkestrasi dhewe dadi produk. Perusahaan iki uga nyedhiyakake sistem kanggo pamirsa Jepang sing kuwatir babagan gumantung banget marang panyedhiya AS, kanthi situs dwibasa lan rega sing ditujokake kanggo pangembang individu lan tim perusahaan.
Pager Nglawan Vendor Lock-In
Ngluwihi kinerja mentah, Sakana AI nyedhiyakake Fugu minangka pangayoman marang katergantungan marang panyedhiya AI tunggal. Perusahaan kasebut nuduhake kontrol ekspor AS anyar sing narik model Anthropic's Fable and Mythos saka pasar manca minangka bukti yen akses menyang sistem ndhuwur bisa ilang sewengi.
"Kanggo organisasi utawa negara, ngandelake API perusahaan siji kanggo infrastruktur kritis, keuangan, utawa pamrentahan minangka kerentanan materi," tulis Sakana AI ing woro-woro kasebut. Amarga blumbang model Fugu bisa diganti kanthi lengkap, sistem bisa ngowahi rute menyang model liyane yen salah siji panyedhiya dadi peteng.
Analis ngati-ati manawa iki ora padha karo kedaulatan sejati. Kinerja Fugu gumantung marang model sing ana ing blumbang, lan sawetara panyedhiya ndhuwur sing mbatesi akses bebarengan bakal tetep nyuda pilihane. Perusahaan kasebut uga durung ngumumake kepiye lapisan orkestrasi nyebabake panggunaan lan biaya token. Nanging, amarga model perbatasan dadi aset geopolitik lan kunci vendor tunggal dadi luwih beresiko, Fugu nawakake pratinjau industri AI sing koordinasi bisa uga penting.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →



