A Sakana AI, sediada em Tóquio, lançou o Fugu, um sistema que oferece o desempenho de um modelo de IA de fronteira, coordenando dinamicamente muitos modelos ao mesmo tempo. Em vez de construir uma rede neural gigante, o próprio Fugu é um modelo de linguagem treinado para chamar outros LLMs de um “pool de agentes” trocável, reunindo uma equipe de modelos especializados para cada tarefa e sintetizando sua saída por meio de uma única API compatível com OpenAI.

O lançamento, coberto pelo THE DECODER, MarkTechPost e MIT Sloan Management Review, representa uma aposta de que o próximo salto no desempenho da IA ​​pode vir menos da escala bruta e mais de uma coordenação mais inteligente dos modelos que já existem. Para mais contexto sobre esta história, confira nossa atualizações de inteligência artificial.

Um modelo para comandar todos eles

Para o usuário, o Fugu se comporta como um modelo único. Nos bastidores, ele lida com uma solicitação por conta própria ou reúne uma equipe de modelos especializados, gerenciando internamente a seleção, delegação, verificação e síntese. Sakana AI diz que a abordagem se baseia em trabalhos anteriores, como o ALE-Agent, que ficou em 21º lugar entre 1.000 especialistas humanos em uma competição de codificação usando técnicas de orquestração.

A empresa está lançando duas variantes. O modelo básico do Fugu visa baixa latência e desempenho diário sólido em casos de uso de codificação, revisão de código e chatbot, e permite que as equipes excluam agentes específicos do pool para privacidade ou conformidade. O Fugu Ultra foi desenvolvido para oferecer a máxima qualidade de resposta em problemas complexos e de várias etapas, como reprodução de artigos científicos, análise de segurança cibernética e pesquisas de patentes e literatura.

Reivindicações de referência que chamam a atenção

De acordo com os resultados de benchmark publicados pela Sakana AI, o Fugu Ultra tem um desempenho equivalente ao Fable 5 e Mythos Preview da Anthropic em uma variedade de benchmarks de codificação, raciocínio e ciência. Notavelmente, nenhum dos modelos Antrópicos está realmente no grupo de agentes do Fugu porque não estão disponíveis publicamente, o que significa que o Fugu alcançou pontuações comparáveis ​​usando outros modelos.

Os números publicados são impressionantes. No SWE-Bench Pro, o Fugu Ultra pontuou 73,7, à frente do Opus 4.8 com 69,2, Gemini 3.1 Pro com 54,2 e GPT 5,5 com 58,6. No TerminalBench 2.1 marcou 80,2 contra 82,1 do Opus 4.8. No LiveCodeBench atingiu 93,2 contra 85,3 do GPT 5.5, e no Último Exame da Humanidade postou 50,0, superando 49,8 do Opus 4.8 e 41,4 do GPT 5.5.

Testes do mundo real pintam um quadro misto

As primeiras análises práticas foram menos entusiásticas do que os benchmarks. O pesquisador de IA Ethan Mollick escreveu no X que o Fugu Ultra é “incrivelmente lento”, com seus testes de codificação habituais demorando 30 minutos e resultados que foram “bons”, mas ficaram aquém do Fable na prática. Outro usuário relatou estourar uma cota inteira de cinco horas no plano de US$ 20 com um único aviso, enquanto os desenvolvedores do Hacker News reclamaram que o plano de US$ 200 por mês rende menos de três horas por semana de tempo útil.

As revisões de código surgiram como um ponto positivo, correspondendo aproximadamente à qualidade do Opus 4.8 ou GPT 5.5. Um teste comparativo mostrou que o Fugu Ultra terminou uma tarefa de codificação em 22 minutos por US$ 7,32, muito mais rápido e mais barato que os 79 minutos do Opus 4.8 e US$ 37,85, embora o revisor preferisse a produção do Opus.

Sakana AI, fundada em Tóquio em 2023 e apoiada pela Nvidia, construiu sua identidade com base em pesquisas de IA inspiradas na natureza, usando algoritmos evolutivos e ideias de inteligência coletiva para extrair mais desempenho dos modelos existentes. A Fugu estende essa filosofia ao mercado comercial, transformando a própria orquestração em um produto. A empresa também está posicionando o sistema para um público japonês preocupado com a dependência excessiva de fornecedores dos EUA, com um site bilíngue e preços voltados tanto para desenvolvedores individuais quanto para equipes empresariais.

Uma proteção contra o aprisionamento do fornecedor

Além do desempenho bruto, a Sakana AI está lançando o Fugu como uma salvaguarda contra a dependência de qualquer fornecedor de IA. A empresa apontou os recentes controles de exportação dos EUA que retiraram os modelos Fable e Mythos da Anthropic dos mercados estrangeiros como prova de que o acesso aos principais sistemas pode desaparecer da noite para o dia.

“Para uma organização ou nação, depender de APIs de uma única empresa para infraestrutura crítica, finanças ou governança é uma vulnerabilidade material”, escreveu a Sakana AI em seu anúncio. Como o conjunto de modelos do Fugu é totalmente trocável, o sistema pode redirecionar para outros modelos se um provedor for desativado.

Os analistas alertam que isto não é o mesmo que verdadeira soberania. O desempenho do Fugu depende de quais modelos estão em seu pool, e vários provedores importantes que restringem o acesso ao mesmo tempo ainda reduziriam suas opções. A empresa também não divulgou o quanto a camada de orquestração aumenta o uso e o custo do token. Ainda assim, à medida que os modelos de fronteira se tornam activos geopolíticos e o aprisionamento de um único fornecedor se torna mais arriscado, Fugu oferece uma antevisão de uma indústria de IA onde a coordenação pode ser tão importante como a capacidade.

---

Fique à Frente da IA

As últimas notícias, análises e avanços em inteligência artificial — tudo em um só lugar.

Ler mais notícias de IA →