Sakana AI, cu sediul în Tokyo, a lansat Fugu, un sistem care oferă performanța unui model AI de frontieră prin coordonarea dinamică a mai multor modele simultan. În loc să construiască o rețea neuronală uriașă, Fugu este în sine un model de limbaj antrenat să apeleze alte LLM-uri dintr-un „pool de agenți” interschimbabil, formând o echipă de modele specializate pentru fiecare sarcină și sintetizând rezultatele lor printr-un singur API compatibil OpenAI.
Lansarea, acoperită de THE DECODER, MarkTechPost și MIT Sloan Management Review, reprezintă un pariu că următorul salt în performanța AI poate proveni mai puțin din scară brută și mai mult din coordonarea mai inteligentă a modelelor care există deja. For more context on this story, see our ongoing latest AI developments.
Un model pentru a le comanda pe toți
Pentru utilizator, Fugu se comportă ca un singur model. Sub capotă, fie se ocupă de o cerere pe cont propriu, fie reunește o echipă de modele specializate, gestionând selecția, delegarea, verificarea și sinteza intern. Sakana AI spune că abordarea se bazează pe lucrări anterioare, cum ar fi ALE-Agent, care a plasat pe locul 21 din 1.000 de experți umani într-o competiție de codificare folosind tehnici de orchestrare.
Compania lansează două variante. Modelul de bază Fugu vizează o latență scăzută și o performanță de zi cu zi solidă în cazuri de codificare, revizuire a codului și chatbot și permite echipelor să excludă anumiți agenți din grup pentru confidențialitate sau conformitate. Fugu Ultra este construit pentru o calitate maximă a răspunsurilor la probleme complexe, cu mai multe etape, cum ar fi reproducerea lucrărilor științifice, analiza securității cibernetice și căutările de brevete și literatură.
Afirmații de referință care învârt capetele
Conform rezultatelor de referință publicate de Sakana AI, Fugu Ultra are performanțe similare cu Anthropic's Fable 5 și Mythos Preview într-o gamă largă de benchmark-uri de codare, raționament și știință. În mod remarcabil, niciun model Anthropic nu se află de fapt în grupul de agenți al lui Fugu, deoarece nu sunt disponibile public, ceea ce înseamnă că Fugu a atins scoruri comparabile folosind alte modele.
Cifrele publicate sunt izbitoare. Pe SWE-Bench Pro, Fugu Ultra a obținut 73,7, înaintea lui Opus 4,8 cu 69,2, Gemini 3.1 Pro cu 54,2 și GPT 5,5 cu 58,6. Pe TerminalBench 2.1 a obținut 80,2 față de 82,1 pentru Opus 4.8. Pe LiveCodeBench a ajuns la 93,2 față de 85,3 pentru GPT 5.5, iar la Humanity's Last Exam a postat 50,0, depășind 49,8 pentru Opus 4.8 și 41,4 pentru GPT 5.5.
Testele din lumea reală pictează o imagine mixtă
Evaluările practice timpurii au fost mai puțin entuziaste decât benchmark-urile. Cercetătorul AI Ethan Mollick a scris pe X că Fugu Ultra este „incredibil de lent”, testele sale obișnuite de codare durand 30 de minute și rezultate care au fost „bine”, dar nu au fost în practică de Fable. Un alt utilizator a raportat că a trecut printr-o cotă întreagă de cinci ore pentru planul de 20 de dolari cu o singură solicitare, în timp ce dezvoltatorii de la Hacker News s-au plâns că planul de 200 de dolari pe lună oferă mai puțin de trei ore pe săptămână de timp utilizabil.
Recenziile de cod au apărut ca un punct luminos, care se potrivesc aproximativ cu Opus 4.8 sau GPT 5.5 în calitate. Un test head-to-head a arătat că Fugu Ultra termină o sarcină de codare în 22 de minute pentru 7,32 USD, mult mai rapid și mai ieftin decât cele 79 de minute și 37,85 USD ale Opus 4.8, deși recenzentul a preferat rezultatul lui Opus.
Sakana AI, fondată la Tokyo în 2023 și susținută de Nvidia, și-a construit identitatea pe baza cercetării AI inspirate de natură, folosind algoritmi evolutivi și idei de inteligență colectivă pentru a obține mai multă performanță din modelele existente. Fugu extinde această filozofie pe piața comercială, transformând orchestrația în sine într-un produs. Compania poziționează, de asemenea, sistemul pentru un public japonez îngrijorat de dependența excesivă de furnizorii din SUA, cu un site bilingv și prețuri care vizează atât dezvoltatorii individuali, cât și echipele de întreprinderi.
O acoperire împotriva blocării vânzătorilor
Dincolo de performanța brută, Sakana AI prezintă Fugu ca o protecție împotriva dependenței de orice furnizor de AI unic. Compania a subliniat recentele controale ale exporturilor din SUA care au scos modelele Anthropic Fable și Mythos de pe piețele străine ca dovadă că accesul la sistemele de top poate dispărea peste noapte.
„Pentru o organizație sau o națiune, bazarea pe API-urile unei singure companii pentru infrastructura critică, finanțe sau guvernare este o vulnerabilitate materială”, a scris Sakana AI în anunțul său. Deoarece grupul de modele al lui Fugu este complet interschimbabil, sistemul poate redirecționa către alte modele dacă un furnizor se întunecă.
Analiştii avertizează că aceasta nu este acelaşi lucru cu adevărata suveranitate. Performanța lui Fugu depinde de modelele care se află în pool-ul său, iar câțiva furnizori de top care restricționează accesul simultan și-ar micșora opțiunile. De asemenea, compania nu a dezvăluit încă cât de mult stratul de orchestrare crește utilizarea și costul token-ului. Cu toate acestea, pe măsură ce modelele de frontieră devin active geopolitice și blocarea unui singur furnizor devine mai riscantă, Fugu oferă o previzualizare a unei industrii AI în care coordonarea poate conta la fel de mult ca și capacitatea.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →



