Fugu Max e Fugu Ultra v2: o que os novos modelos da Sakana entregam para desenvolvimento full-stack?

Fugu Ultra v2 e Fugu Max, modelos de orquestração da Sakana AI para desenvolvimento full-stack
Resposta rápida

Fugu Ultra v2 e Fugu Max são as duas novas configurações da mesma arquitetura de orquestração da Sakana AI, anunciadas em 11/09/2026 e já disponíveis por API compatível com OpenAI. Fugu não é um modelo de fundação: é um orquestrador que roteia o trabalho entre modelos de um pool open-weight e especialista, incluindo a família NVIDIA Nemotron. O Max custa US$ 2,00 por milhão de tokens de entrada e US$ 6,00 de saída; o Ultra v2 vai a US$ 5,00 e US$ 30,00. Os dois têm 1 milhão de tokens de contexto e até 128 mil de saída

Fala aí, beleza? A Sakana AI lançou hoje, 11/09/2026, o Fugu Max e o Fugu Ultra v2: duas configurações da MESMA arquitetura de orquestração, já disponíveis via API compatível com OpenAI

E tem um detalhe que interessa direto pra quem escreve código: a própria empresa cita desenvolvimento de software full-stack como caso de uso

Então bora aterrissar isso aqui sem ficar repetindo página institucional: o que a proposta cobre de verdade, o que os números mostram, quanto custa e em que tipo de tarefa cada configuração faz sentido 🙂

O que é o Fugu e por que ele não é mais um modelo de fundação

Essa é a parte que muda a forma de pensar a ferramenta

O Fugu não é um modelo de fundação próprio da Sakana

Ele é um orquestrador aprendido: lê a tua pergunta, monta um scaffold de agentes e roteia o trabalho por um pool de outros modelos, tudo atrás de uma única API

Se você já usou um gerenciador de pacotes, a analogia ajuda: você chama um comando só, e por baixo ele resolve de onde vem cada coisa

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 116 aulas
  • 4 projetos
  • 9h 23min

Que pool é esse? É um conjunto de modelos open-weight e especialistas, incluindo a família NVIDIA Nemotron

E aqui vai o ponto que costuma ser mal entendido: o pool do Ultra v2 não depende de modelos proprietários de fronteira individuais

Ele não contém Fable 5, não contém Fable 5.1 e não contém GPT-6 Astra

Os casos de uso que a Sakana coloca na frente são três: raciocínio multi-etapas complexo, pesquisa autônoma e desenvolvimento de software full-stack

Os dois modelos ficaram disponíveis no mesmo dia do anúncio

Vídeo: a IA que usa vários modelos ao mesmo tempo

Pra começar do zero com a ideia de uma IA que usa vários modelos ao mesmo tempo, se liga neste vídeo do canal, que introduz o assunto do Sakana Fugu

O que os benchmarks reportados pela Sakana dizem sobre código

Agora a parte dos números, com a ressalva lá no começo e não escondida no rodapé: todos esses resultados são reportados pela própria Sakana

No Ultra v2, o dado mais relevante pra dev é o DeepSWE, benchmark de engenharia de software do mundo real: 74,3

A empresa também diz que o Ultra v2 ficou melhor ou empatado em primeiro em cinco de oito benchmarks: GDP.pdf, Chartography, SWEFish, DeepSWE e Toolathon

O Chartography, que testa raciocínio visual e interpretação de dados, é o resultado com a maior distância: 48,3 contra 27,3 do Opus 5 e 29,5 do Fable 5

Já o Fugu Max aparece com a melhor pontuação geral em seis benchmarks: Terminal Bench 2.1, GPQA Diamond, AA-LCR, GDP.pdf, AutomationBench e SWEFish

E, segundo a Sakana, ele expande a fronteira de Pareto custo-performance em 7 de 10 benchmarks

Tome cuidado com um detalhe: o SWEFish é um benchmark INTERNO da Sakana, construído a partir dos próprios desafios de código e casos de uso da empresa

Ou seja, não é um benchmark público independente

E repara na sobreposição das duas listas: SWEFish e GDP.pdf aparecem tanto na lista do Ultra v2 quanto na do Max, então esses dois pesam duas vezes na leitura geral

Isso não invalida o resto, só muda o peso que você dá pra cada linha 🙂

Fugu Max x Fugu Ultra v2: preço, latência e contexto lado a lado

Item Fugu Max Fugu Ultra v2
Entrada (por milhão de tokens) US$ 2,00 US$ 5,00
Saída (por milhão de tokens) US$ 6,00 US$ 30,00
Acima de 272 mil tokens de contexto preço plano, não muda entrada passa a US$ 10,00 e a saída também sobe
Cache read US$ 0,25/M US$ 0,50/M (US$ 1,00 acima de 272K)
Busca web US$ 0,007 por chamada de busca ou fetch US$ 10,00 por mil chamadas
Janela de contexto 1.000.000 de tokens 1.000.000 de tokens
Saída máxima 128.000 tokens 128.000 tokens
Tokens por segundo cerca de 62 cerca de 49
Time-to-first-token (p50) 3,6s 24,7s

Lendo a tabela: os dois têm exatamente a mesma janela de contexto e o mesmo teto de saída, então a escolha não passa por "quanto cabe"

Ela passa por preço e por tempo de resposta

O Max é mais barato na entrada e MUITO mais barato na saída, e o preço dele é plano, não muda quando o contexto estoura os 272 mil tokens

O Ultra v2 cobra mais e ainda muda de faixa acima de 272K: a entrada dobra e a saída também sobe

A diferença de time-to-first-token também é grande: 3,6s contra 24,7s no p50

A Sakana posiciona o preço do Fugu Max como 40% a 60% abaixo de concorrentes diretos, citando Sonnet 5, GPT 5.6 Terra e Kimi K3

Isso é posicionamento da empresa, beleza? Os valores da tabela é que são o dado duro

Que tipo de trabalho full-stack se beneficia de cada configuração

Aqui é onde o roteamento entre modelos encosta no teu dia a dia

Tarefas de laço curto e alto volume:

Pensa em loop de agente no terminal, edição iterativa de arquivo, renomear coisa, ajustar teste que quebrou, automação rodando em cima de muitos itens

Nesse perfil, o que dói é esperar o primeiro token e ver a conta subir a cada chamada

Os 3,6s de TTFT, os 62 tokens por segundo e o preço plano independente do tamanho do contexto conversam direto com esse cenário no Fugu Max

Tarefas de laço longo:

Refatoração multi-arquivo, leitura de uma base inteira antes de mexer, investigação que precisa de várias etapas encadeadas, entrada que não é só texto

É o terreno onde a Sakana posiciona o Ultra v2, junto com raciocínio multi-etapas complexo e pesquisa autônoma

Do lado do que dá pra verificar na API, o Ultra v2 aceita:

  • esforço de raciocínio configurável (high e xhigh; max é aceito por compatibilidade e mapeia para xhigh)
  • function calling
  • structured outputs via JSON schema
  • entrada de texto, imagens e arquivos como PDF
  • busca web embutida
  • saída em texto

Aceitar PDF e imagem como entrada não é detalhe pequeno em full-stack: print de erro, diagrama de arquitetura e documento de especificação entram no mesmo pedido

E tem o 1 milhão de tokens de contexto, que está nos DOIS

Isso muda o que cabe numa requisição só: dá pra jogar um módulo inteiro em vez de ficar recortando arquivo por arquivo pra caber

Um aviso honesto: benchmark reportado pela empresa e número de preço/latência são coisas diferentes

O segundo você consegue conferir na hora, rodando a tua própria tarefa

Como colocar o Fugu para rodar no seu fluxo de código

Existem dois caminhos: API direta e os lançadores oficiais pra CLI de código

  1. Crie a chave de API no console da Sakana, em console.sakana.ai
  1. Aponte o teu SDK OpenAI padrão pro endpoint compatível: o base_url é https://api.sakana.ai/v1, e a chave é a que você acabou de emitir
from openai import OpenAI

client = OpenAI(
    api_key="SUA_CHAVE_DO_CONSOLE",
    base_url="https://api.sakana.ai/v1",
)

resp = client.chat.completions.create(
    model="fugu-ultra-v2.0",
    messages=[
        {"role": "user", "content": "Explique o fluxo de autenticação deste projeto"}
    ],
)

print(resp.choices[0].message.content)
  1. Escolha o formato de API que você já usa: o mesmo endpoint suporta Chat Completions, Responses e Anthropic Messages
  1. Troque o modelo mudando UMA linha: o identificador do Fugu Ultra v2 na API da Sakana é fugu-ultra-v2.0, então a migração é alteração no parâmetro de modelo, sem trocar de SDK

O erro comum deste passo é sair reescrevendo cliente e wrapper achando que precisa de biblioteca nova

  1. Se você prefere ir por OpenRouter, os slugs são sakana/fugu-ultra-v2 e sakana/fugu-max
  1. Pra usar dentro do Codex ou do Claude Code, o caminho é o repositório oficial mantido pela Sakana: SakanaAI/fugu, que traz instalação em uma linha pros dois

O que esse instalador faz: o bootstrap servido em https://sakana.ai/fugu/install clona o repositório em ~/.fugu e executa ~/.fugu/scripts/install.sh, que fixa a versão do Codex, instala a config do Fugu e guarda a tua chave de API

Repara numa coisa: o que está documentado sobre fixar versão é do lado do Codex

Pro Claude Code, o que o repositório traz é o guia de setup manual das configs, e é por ali que tu resolve o que o instalador não cobrir

O suporte oficial é Ubuntu e macOS

Se você está no Windows, o caminho é o setup manual, então já conta com esse tempo a mais

  1. No Codex, o lançador é codex-fugu: ele roda codex -p fugu e, no máximo uma vez por hora, verifica atualizações de config no repositório

Os argumentos que você passar vão direto pro Codex

  1. No Claude Code, o lançador é claude-fugu

Atenção nesse aqui: ele NÃO se auto-atualiza

Pra receber suporte a novos modelos Fugu, é preciso rodar a instalação de novo ou reimplantar as configs seguindo o guia de setup manual do Claude Code no repositório

É exatamente o tipo de coisa que faz alguém achar que o modelo novo "não apareceu", quando na real é a config parada

  1. Por fim, decida a cobrança: dá pra ficar no pay-as-you-go por token ou ir de assinatura, com Standard a US$ 20/mês, Pro a US$ 100/mês (10x o uso do Standard) e Max a US$ 200/mês (20x o uso do Standard)

Vale testar agora?

O diferencial declarado do Fugu é esse: roteamento entre modelos diferentes atrás de uma única API, sem você precisar orquestrar isso na mão

A proposta é boa no papel, e os números de código são bons

Mas os números são reportados pela própria Sakana, e parte deles vem de benchmark interno da empresa

Então a avaliação que vale é a tua, no teu código

O próximo passo barato: cria a chave no console, aponta o base_url do SDK que você já usa e roda uma tarefa REAL do teu projeto no Fugu Max primeiro, que é mais barato e entrega o primeiro token bem mais rápido

Se a tarefa for longa, multi-arquivo ou tiver PDF e imagem no meio, aí sim faz sentido medir se o Ultra v2 compensa a diferença de preço

Rodou aí? Conta nos comentários qual resultado apareceu, principalmente se você comparou as duas configurações na mesma tarefa

até o próximo post! =)

Perguntas frequentes

Como instalar e rodar o Fugu dentro do Claude Code?

O repositório oficial é o github.com/SakanaAI/fugu, mantido pela Sakana AI, com um bootstrap servido em sakana.ai/fugu/install que clona tudo em ~/.fugu e roda o script de instalação, guardando a chave de API. Depois disso, o launcher claude-fugu roda o Fugu dentro do Claude Code. Vale lembrar que esse launcher não se auto-atualiza, então pra pegar suporte a modelos novos é preciso rodar a instalação de novo ou reimplantar as configs pelo guia de setup manual do Claude Code no repositório (suporte oficial é Ubuntu e macOS, com setup manual no Windows).

Qual o identificador do Fugu Ultra v2 pra usar direto na API?

É fugu-ultra-v2.0, e trocar de modelo é literalmente mudar esse parâmetro numa linha só, sem precisar migrar de SDK. O endpoint é compatível com OpenAI, então quem já tem integração pronta só aponta o base_url pra https://api.sakana.ai/v1 e usa a chave gerada em console.sakana.ai.

Dá pra rodar o Fugu Ultra v2 pelo OpenRouter?

Dá sim: o slug é sakana/fugu-ultra-v2, e o Fugu Max aparece como sakana/fugu-max. É outra porta de entrada além da API oficial da Sakana.

Quanto custam os planos de assinatura do Fugu, e como eles se diferenciam do preço por token?

Existem três planos: Standard a US$ 20/mês, Pro a US$ 100/mês (10x o uso do Standard) e Max a US$ 200/mês (20x o uso do Standard). Quem prefere não assinar também pode usar o modelo pay-as-you-go, pagando pelos valores por token que aparecem na tabela de preço da API.

O Fugu funciona com os SDKs padrão da OpenAI e com a Anthropic Messages API?

Sim, o mesmo endpoint da Sakana suporta três formatos: Chat Completions, Responses e Anthropic Messages. Como o acesso é via API compatível com OpenAI (base_url https://api.sakana.ai/v1 e chave emitida em console.sakana.ai), SDKs OpenAI padrão conectam só apontando essas duas configurações.

Como o Fugu é lançado dentro do Codex?

O comando é codex-fugu, que executa codex -p fugu por baixo e checa atualizações de configuração no repositório no máximo uma vez por hora. Qualquer argumento adicional que você passar vai direto pro Codex, sem precisar de sintaxe própria do Fugu.




Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares