Fugu Max e Fugu Ultra v2: o que os novos modelos da Sakana entregam para desenvolvimento full-stack?

Fugu Ultra v2 e Fugu Max são as duas novas configurações da mesma arquitetura de orquestração da Sakana AI, anunciadas em 11/09/2026 e já disponíveis por API compatível com OpenAI. Fugu não é um modelo de fundação: é um orquestrador que roteia o trabalho entre modelos de um pool open-weight e especialista, incluindo a família NVIDIA Nemotron. O Max custa US$ 2,00 por milhão de tokens de entrada e US$ 6,00 de saída; o Ultra v2 vai a US$ 5,00 e US$ 30,00. Os dois têm 1 milhão de tokens de contexto e até 128 mil de saída
Fala aí, beleza? A Sakana AI lançou hoje, 11/09/2026, o Fugu Max e o Fugu Ultra v2: duas configurações da MESMA arquitetura de orquestração, já disponíveis via API compatível com OpenAI
E tem um detalhe que interessa direto pra quem escreve código: a própria empresa cita desenvolvimento de software full-stack como caso de uso
Então bora aterrissar isso aqui sem ficar repetindo página institucional: o que a proposta cobre de verdade, o que os números mostram, quanto custa e em que tipo de tarefa cada configuração faz sentido 🙂
O que é o Fugu e por que ele não é mais um modelo de fundação
Essa é a parte que muda a forma de pensar a ferramenta
O Fugu não é um modelo de fundação próprio da Sakana
Ele é um orquestrador aprendido: lê a tua pergunta, monta um scaffold de agentes e roteia o trabalho por um pool de outros modelos, tudo atrás de uma única API
Se você já usou um gerenciador de pacotes, a analogia ajuda: você chama um comando só, e por baixo ele resolve de onde vem cada coisa
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 116 aulas
- 4 projetos
- 9h 23min
Que pool é esse? É um conjunto de modelos open-weight e especialistas, incluindo a família NVIDIA Nemotron
E aqui vai o ponto que costuma ser mal entendido: o pool do Ultra v2 não depende de modelos proprietários de fronteira individuais
Ele não contém Fable 5, não contém Fable 5.1 e não contém GPT-6 Astra
Os casos de uso que a Sakana coloca na frente são três: raciocínio multi-etapas complexo, pesquisa autônoma e desenvolvimento de software full-stack
Os dois modelos ficaram disponíveis no mesmo dia do anúncio
Vídeo: a IA que usa vários modelos ao mesmo tempo
Pra começar do zero com a ideia de uma IA que usa vários modelos ao mesmo tempo, se liga neste vídeo do canal, que introduz o assunto do Sakana Fugu
O que os benchmarks reportados pela Sakana dizem sobre código
Agora a parte dos números, com a ressalva lá no começo e não escondida no rodapé: todos esses resultados são reportados pela própria Sakana
No Ultra v2, o dado mais relevante pra dev é o DeepSWE, benchmark de engenharia de software do mundo real: 74,3
A empresa também diz que o Ultra v2 ficou melhor ou empatado em primeiro em cinco de oito benchmarks: GDP.pdf, Chartography, SWEFish, DeepSWE e Toolathon
O Chartography, que testa raciocínio visual e interpretação de dados, é o resultado com a maior distância: 48,3 contra 27,3 do Opus 5 e 29,5 do Fable 5
Já o Fugu Max aparece com a melhor pontuação geral em seis benchmarks: Terminal Bench 2.1, GPQA Diamond, AA-LCR, GDP.pdf, AutomationBench e SWEFish
E, segundo a Sakana, ele expande a fronteira de Pareto custo-performance em 7 de 10 benchmarks
Tome cuidado com um detalhe: o SWEFish é um benchmark INTERNO da Sakana, construído a partir dos próprios desafios de código e casos de uso da empresa
Ou seja, não é um benchmark público independente
E repara na sobreposição das duas listas: SWEFish e GDP.pdf aparecem tanto na lista do Ultra v2 quanto na do Max, então esses dois pesam duas vezes na leitura geral
Isso não invalida o resto, só muda o peso que você dá pra cada linha 🙂
Fugu Max x Fugu Ultra v2: preço, latência e contexto lado a lado
| Item | Fugu Max | Fugu Ultra v2 |
|---|---|---|
| Entrada (por milhão de tokens) | US$ 2,00 | US$ 5,00 |
| Saída (por milhão de tokens) | US$ 6,00 | US$ 30,00 |
| Acima de 272 mil tokens de contexto | preço plano, não muda | entrada passa a US$ 10,00 e a saída também sobe |
| Cache read | US$ 0,25/M | US$ 0,50/M (US$ 1,00 acima de 272K) |
| Busca web | US$ 0,007 por chamada de busca ou fetch | US$ 10,00 por mil chamadas |
| Janela de contexto | 1.000.000 de tokens | 1.000.000 de tokens |
| Saída máxima | 128.000 tokens | 128.000 tokens |
| Tokens por segundo | cerca de 62 | cerca de 49 |
| Time-to-first-token (p50) | 3,6s | 24,7s |
Lendo a tabela: os dois têm exatamente a mesma janela de contexto e o mesmo teto de saída, então a escolha não passa por "quanto cabe"
Ela passa por preço e por tempo de resposta
O Max é mais barato na entrada e MUITO mais barato na saída, e o preço dele é plano, não muda quando o contexto estoura os 272 mil tokens
O Ultra v2 cobra mais e ainda muda de faixa acima de 272K: a entrada dobra e a saída também sobe
A diferença de time-to-first-token também é grande: 3,6s contra 24,7s no p50
A Sakana posiciona o preço do Fugu Max como 40% a 60% abaixo de concorrentes diretos, citando Sonnet 5, GPT 5.6 Terra e Kimi K3
Isso é posicionamento da empresa, beleza? Os valores da tabela é que são o dado duro
Que tipo de trabalho full-stack se beneficia de cada configuração
Aqui é onde o roteamento entre modelos encosta no teu dia a dia
Tarefas de laço curto e alto volume:
Pensa em loop de agente no terminal, edição iterativa de arquivo, renomear coisa, ajustar teste que quebrou, automação rodando em cima de muitos itens
Nesse perfil, o que dói é esperar o primeiro token e ver a conta subir a cada chamada
Os 3,6s de TTFT, os 62 tokens por segundo e o preço plano independente do tamanho do contexto conversam direto com esse cenário no Fugu Max
Tarefas de laço longo:
Refatoração multi-arquivo, leitura de uma base inteira antes de mexer, investigação que precisa de várias etapas encadeadas, entrada que não é só texto
É o terreno onde a Sakana posiciona o Ultra v2, junto com raciocínio multi-etapas complexo e pesquisa autônoma
Do lado do que dá pra verificar na API, o Ultra v2 aceita:
- esforço de raciocínio configurável (
highexhigh;maxé aceito por compatibilidade e mapeia paraxhigh) - function calling
- structured outputs via JSON schema
- entrada de texto, imagens e arquivos como PDF
- busca web embutida
- saída em texto
Aceitar PDF e imagem como entrada não é detalhe pequeno em full-stack: print de erro, diagrama de arquitetura e documento de especificação entram no mesmo pedido
E tem o 1 milhão de tokens de contexto, que está nos DOIS
Isso muda o que cabe numa requisição só: dá pra jogar um módulo inteiro em vez de ficar recortando arquivo por arquivo pra caber
Um aviso honesto: benchmark reportado pela empresa e número de preço/latência são coisas diferentes
O segundo você consegue conferir na hora, rodando a tua própria tarefa
Como colocar o Fugu para rodar no seu fluxo de código
Existem dois caminhos: API direta e os lançadores oficiais pra CLI de código
- Crie a chave de API no console da Sakana, em
console.sakana.ai
- Aponte o teu SDK OpenAI padrão pro endpoint compatível: o
base_urléhttps://api.sakana.ai/v1, e a chave é a que você acabou de emitir
from openai import OpenAI
client = OpenAI(
api_key="SUA_CHAVE_DO_CONSOLE",
base_url="https://api.sakana.ai/v1",
)
resp = client.chat.completions.create(
model="fugu-ultra-v2.0",
messages=[
{"role": "user", "content": "Explique o fluxo de autenticação deste projeto"}
],
)
print(resp.choices[0].message.content)
- Escolha o formato de API que você já usa: o mesmo endpoint suporta Chat Completions, Responses e Anthropic Messages
- Troque o modelo mudando UMA linha: o identificador do Fugu Ultra v2 na API da Sakana é
fugu-ultra-v2.0, então a migração é alteração no parâmetro de modelo, sem trocar de SDK
O erro comum deste passo é sair reescrevendo cliente e wrapper achando que precisa de biblioteca nova
- Se você prefere ir por OpenRouter, os slugs são
sakana/fugu-ultra-v2esakana/fugu-max
- Pra usar dentro do Codex ou do Claude Code, o caminho é o repositório oficial mantido pela Sakana: SakanaAI/fugu, que traz instalação em uma linha pros dois
O que esse instalador faz: o bootstrap servido em https://sakana.ai/fugu/install clona o repositório em ~/.fugu e executa ~/.fugu/scripts/install.sh, que fixa a versão do Codex, instala a config do Fugu e guarda a tua chave de API
Repara numa coisa: o que está documentado sobre fixar versão é do lado do Codex
Pro Claude Code, o que o repositório traz é o guia de setup manual das configs, e é por ali que tu resolve o que o instalador não cobrir
O suporte oficial é Ubuntu e macOS
Se você está no Windows, o caminho é o setup manual, então já conta com esse tempo a mais
- No Codex, o lançador é
codex-fugu: ele rodacodex -p fugue, no máximo uma vez por hora, verifica atualizações de config no repositório
Os argumentos que você passar vão direto pro Codex
- No Claude Code, o lançador é
claude-fugu
Atenção nesse aqui: ele NÃO se auto-atualiza
Pra receber suporte a novos modelos Fugu, é preciso rodar a instalação de novo ou reimplantar as configs seguindo o guia de setup manual do Claude Code no repositório
É exatamente o tipo de coisa que faz alguém achar que o modelo novo "não apareceu", quando na real é a config parada
- Por fim, decida a cobrança: dá pra ficar no pay-as-you-go por token ou ir de assinatura, com Standard a US$ 20/mês, Pro a US$ 100/mês (10x o uso do Standard) e Max a US$ 200/mês (20x o uso do Standard)
Vale testar agora?
O diferencial declarado do Fugu é esse: roteamento entre modelos diferentes atrás de uma única API, sem você precisar orquestrar isso na mão
A proposta é boa no papel, e os números de código são bons
Mas os números são reportados pela própria Sakana, e parte deles vem de benchmark interno da empresa
Então a avaliação que vale é a tua, no teu código
O próximo passo barato: cria a chave no console, aponta o base_url do SDK que você já usa e roda uma tarefa REAL do teu projeto no Fugu Max primeiro, que é mais barato e entrega o primeiro token bem mais rápido
Se a tarefa for longa, multi-arquivo ou tiver PDF e imagem no meio, aí sim faz sentido medir se o Ultra v2 compensa a diferença de preço
Rodou aí? Conta nos comentários qual resultado apareceu, principalmente se você comparou as duas configurações na mesma tarefa
até o próximo post! =)
Perguntas frequentes
Como instalar e rodar o Fugu dentro do Claude Code?
O repositório oficial é o github.com/SakanaAI/fugu, mantido pela Sakana AI, com um bootstrap servido em sakana.ai/fugu/install que clona tudo em ~/.fugu e roda o script de instalação, guardando a chave de API. Depois disso, o launcher claude-fugu roda o Fugu dentro do Claude Code. Vale lembrar que esse launcher não se auto-atualiza, então pra pegar suporte a modelos novos é preciso rodar a instalação de novo ou reimplantar as configs pelo guia de setup manual do Claude Code no repositório (suporte oficial é Ubuntu e macOS, com setup manual no Windows).
Qual o identificador do Fugu Ultra v2 pra usar direto na API?
É fugu-ultra-v2.0, e trocar de modelo é literalmente mudar esse parâmetro numa linha só, sem precisar migrar de SDK. O endpoint é compatível com OpenAI, então quem já tem integração pronta só aponta o base_url pra https://api.sakana.ai/v1 e usa a chave gerada em console.sakana.ai.
Dá pra rodar o Fugu Ultra v2 pelo OpenRouter?
Dá sim: o slug é sakana/fugu-ultra-v2, e o Fugu Max aparece como sakana/fugu-max. É outra porta de entrada além da API oficial da Sakana.
Quanto custam os planos de assinatura do Fugu, e como eles se diferenciam do preço por token?
Existem três planos: Standard a US$ 20/mês, Pro a US$ 100/mês (10x o uso do Standard) e Max a US$ 200/mês (20x o uso do Standard). Quem prefere não assinar também pode usar o modelo pay-as-you-go, pagando pelos valores por token que aparecem na tabela de preço da API.
O Fugu funciona com os SDKs padrão da OpenAI e com a Anthropic Messages API?
Sim, o mesmo endpoint da Sakana suporta três formatos: Chat Completions, Responses e Anthropic Messages. Como o acesso é via API compatível com OpenAI (base_url https://api.sakana.ai/v1 e chave emitida em console.sakana.ai), SDKs OpenAI padrão conectam só apontando essas duas configurações.
Como o Fugu é lançado dentro do Codex?
O comando é codex-fugu, que executa codex -p fugu por baixo e checa atualizações de configuração no repositório no máximo uma vez por hora. Qualquer argumento adicional que você passar vai direto pro Codex, sem precisar de sintaxe própria do Fugu.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares

Quanto custa o Fugu Max e o Fugu Ultra v2 por milhão de tokens?
Fugu Max preço por milhão de tokens: valores de entrada e saída, comparação com o Fugu Ultra v2 e com Sonnet 5, GPT 5.6 Terra e Kimi K3.

Fugu Ultra v2 e Fugu Max: o que muda na pesquisa autônoma e no raciocínio de múltiplas etapas?
Fugu Ultra v2 chega com a Sakana AI: veja preço, contexto de 1M de tokens, score no Chartography e como se compara ao Fugu Max na pesquisa autônoma.
O que significa “ChatGPT network error” e como resolver
O “ChatGPT Network Error” é uma ocorrência frequente na rotina de muitos usuários do ChatGPT. Porém, poucos compreendem seu significado, quando esse erro surge, etc. […]
