Sakana AI se sídlem v Tokiu spustila Fugu, systém, který poskytuje výkon hraničního modelu AI dynamickou koordinací mnoha modelů najednou. Namísto budování jedné obří neuronové sítě je Fugu sám o sobě jazykovým modelem trénovaným k volání jiných LLM z vyměnitelného „agent poolu“, přičemž sestavuje tým specializovaných modelů pro každý úkol a syntetizuje jejich výstup prostřednictvím jediného API kompatibilního s OpenAI.

Uvedení na trh, které zastřešují THE DECODER, MarkTechPost a MIT Sloan Management Review, představuje sázku, že další skok ve výkonu umělé inteligence může přijít méně z hrubého rozsahu a více z chytřejší koordinace modelů, které již existují. For more context on this story, see our ongoing artificial intelligence updates.

Jeden model, který je bude řídit všem

Pro uživatele se Fugu chová jako jeden model. Pod kapotou buď zpracovává požadavek sám, nebo shromažďuje tým specializovaných modelů, kteří interně řídí výběr, delegování, kontrolu a syntézu. Sakana AI říká, že tento přístup staví na dřívější práci, jako je její ALE-Agent, který se umístil na 21. místě z 1000 lidských expertů v kódovací soutěži využívající techniky orchestrace.

Společnost vydává dvě varianty. Základní model Fugu se zaměřuje na nízkou latenci a solidní každodenní výkon napříč případy kódování, kontroly kódu a chatbotů a umožňuje týmům vyloučit konkrétní agenty z fondu kvůli ochraně soukromí nebo dodržování předpisů. Fugu Ultra je vytvořen pro maximální kvalitu odpovědí na složité, vícestupňové problémy, jako je reprodukce vědeckých prací, analýza kybernetické bezpečnosti a rešerše patentů a literatury.

Srovnávejte tvrzení, která se otáčejí hlavou

Podle výsledků benchmarku zveřejněných Sakana AI si Fugu Ultra vede na stejné úrovni jako Anthropic's Fable 5 a Mythos Preview v celé řadě kódovacích, uvažovacích a vědeckých benchmarků. Pozoruhodné je, že ani jeden antropický model ve skutečnosti není ve skupině agentů Fugu, protože nejsou veřejně dostupné, což znamená, že Fugu dosáhl srovnatelného skóre pomocí jiných modelů.

Zveřejněná čísla jsou zarážející. Na SWE-Bench Pro dosáhl Fugu Ultra 73,7, před Opus 4,8 na 69,2, Gemini 3,1 Pro na 54,2 a GPT 5,5 na 58,6. Na TerminalBench 2.1 dosáhl skóre 80,2 oproti Opus 4.8 82,1. Na LiveCodeBench dosáhl 93,2 oproti 85,3 GPT 5.5 a na Humanity's Last Exam vykázal 50,0, čímž překonal Opus 4.8 49,8 a GPT 5.5 41,4.

Testy v reálném světě Malujte smíšený obrázek

První praktické recenze byly méně nadšené než srovnávací testy. Výzkumník AI Ethan Mollick na X napsal, že Fugu Ultra je „neuvěřitelně pomalý“, přičemž jeho obvyklé testy kódování trvaly 30 minut a výsledky byly „v pořádku“, ale v praxi zaostávaly za Fable. Jiný uživatel oznámil, že jedinou výzvou překročil celou pětihodinovou kvótu na plánu 20 USD, zatímco vývojáři na Hacker News si stěžovali, že plán 200 USD za měsíc přináší méně než tři hodiny týdně použitelného času.

Recenze kódu se ukázaly jako světlý bod, zhruba odpovídající kvalitě Opus 4.8 nebo GPT 5.5. Jeden přímý test ukázal, že Fugu Ultra dokončí úlohu kódování za 22 minut za 7,32 $, mnohem rychleji a levněji než 79 minut a 37,85 $ u Opusu 4.8, ačkoli recenzent preferoval výstup Opusu.

Sakana AI, založená v Tokiu v roce 2023 a podporovaná společností Nvidia, postavila svou identitu na přírodou inspirovaném výzkumu umělé inteligence pomocí evolučních algoritmů a nápadů kolektivní inteligence, aby ze stávajících modelů vymáčkla větší výkon. Fugu rozšiřuje tuto filozofii na komerční trh a přeměňuje samotnou orchestraci na produkt. Společnost také umístí systém pro japonské publikum, které se obává přílišného spoléhání na americké poskytovatele, s dvojjazyčným webem a cenami zaměřenými jak na jednotlivé vývojáře, tak na podnikové týmy.

Zajištění proti uzamčení dodavatele

Kromě hrubého výkonu nabízí Sakana AI Fugu jako ochranu proti závislosti na jakémkoli jediném poskytovateli AI. Společnost poukázala na nedávné kontroly exportu v USA, které stáhly modely Anthropic's Fable a Mythos ze zahraničních trhů jako důkaz toho, že přístup ke špičkovým systémům může přes noc zmizet.

„Pro organizaci nebo národ je spoléhání se na API jediné společnosti pro kritickou infrastrukturu, finance nebo řízení podstatnou zranitelností,“ napsala Sakana AI ve svém oznámení. Vzhledem k tomu, že fond modelů Fugu je plně vyměnitelný, může systém přesměrovat na jiné modely, pokud jeden poskytovatel zhasne.

Analytici varují, že to není totéž jako skutečná suverenita. Výkon Fugu závisí na tom, které modely jsou v jeho fondu, a několik špičkových poskytovatelů omezujících přístup najednou by stále zmenšovalo jeho možnosti. Společnost také zatím nezveřejnila, jak moc orchestrační vrstva zvyšuje využití tokenů a náklady. Přesto, jak se hraniční modely stávají geopolitickými aktivy a vázání na jednoho dodavatele je stále riskantnější, Fugu nabízí náhled na odvětví umělé inteligence, kde na koordinaci může záležet stejně jako na schopnosti.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →