Quanto custa o Fugu Max e o Fugu Ultra v2 por milhão de tokens?

Fugu Max preço, direto ao ponto: 2 dólares por milhão de tokens de entrada e 6 dólares por milhão de tokens de saída, sem faixa mais cara para contexto longo (cerca de R$ 10,18 e R$ 30,54 no câmbio de R$ 5,09). Já o Fugu Ultra v2 custa 5 dólares de entrada e 30 dólares de saída por milhão, com 0,50 dólar por milhão de entrada em cache, e sobe para 10 e 45 dólares acima de 272 mil tokens de contexto. A própria Sakana AI diz que o output do Max sai de 40% a 60% mais barato que Sonnet 5, GPT 5.6 Terra e Kimi K3
Fala aí, beleza? Quem paga API sabe que a conta não estoura na entrada, ela estoura na SAÍDA
E é exatamente aí que a Sakana AI resolveu atacar
Em 10 de setembro de 2026 ela anunciou o Fugu Max e o Fugu Ultra v2, duas variantes de orquestração do sistema multiagente Fugu
O detalhe que confunde todo mundo: apesar de virem no mesmo anúncio, os dois NÃO compartilham a mesma tabela de preço
Cada um tem a sua, e a distância entre elas é grande
O que são o Fugu Max e o Fugu Ultra v2
Os dois são variantes de orquestração do Fugu, o sistema multiagente da Sakana AI
Orquestração aqui significa o seguinte: em vez de um modelo único mastigando tudo sozinho, existe uma camada que decide qual modelo do time recebe cada tarefa
Se você já usou um gerenciador de pacotes tipo NPM ou composer, a lógica de "tem uma camada resolvendo pra você o que puxar de onde" é bem parecida, só que aqui o que se resolve é qual modelo responde
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 116 aulas
- 4 projetos
- 9h 23min
O Fugu Max roteia cada tarefa para o modelo mais leve capaz de resolvê-la
E ele também amplia o conjunto de modelos que o Fugu orquestra, incluindo modelos de pesos abertos e a família NVIDIA Nemotron
A página de lançamento da Sakana AI afirma que o Fugu Max expande a fronteira de Pareto de custo e desempenho em 7 de 10 benchmarks
Aqui vale o aviso: isso é alegação da página oficial, não foi verificada de forma independente neste post
Número de benchmark de página de lançamento é sempre o melhor cenário possível do fabricante, beleza? 🙂
Os dois modelos têm janela de 1 milhão de tokens de contexto e geram até 128 mil tokens de saída por resposta
Fugu Max vs Sonnet 5, GPT 5.6 Terra e Kimi K3: a comparação de preço
Essa é a tabela que interessa
| Modelo | Input ($/M) | Output ($/M) |
|---|---|---|
| Fugu Max | $2 | $6 |
| Claude Sonnet 5 | $2 | $10 |
| GPT 5.6 Terra | $2 | $12 |
| Kimi K3 | $3 | $15 |
Se você quiser converter pra real, o câmbio canônico deste post é R$ 5,09 (abertura de 11/09/2026)
A faixa de 40% a 60% mais barato no output que a Sakana anuncia bate certinho com esses números
Contra o Sonnet 5, sair de $10 para $6 é 40% a menos
Contra o GPT 5.6 Terra, a saída cai de $12 para $6
Contra o Kimi K3, de $15 para $6 é 60%
Ou seja: a ponta de baixo e a ponta de cima da promessa oficial são exatamente esses três concorrentes
Agora se liga no que a tabela mostra de mais importante
O input do Fugu Max EMPATA com Sonnet 5 e GPT 5.6 Terra: $2 por milhão nos três
A diferença toda mora na saída, em nenhum outro lugar
Sobre o Sonnet 5, um detalhe que muita gente ainda erra: o $2/$10 era promocional até 31 de agosto de 2026 e virou o preço padrão, o aumento para $3/$15 não aconteceu
E tem mais um ponto a favor do Max: o preço é o mesmo em qualquer tamanho de contexto
Não existe faixa mais cara pra prompt longo
Se você já fez esse tipo de conta antes pra outro modelo, o raciocínio é o mesmo de calcular o gasto de API: estime volume, separe entrada de saída, e só depois converta
Fugu Ultra v2: preço padrão e a faixa acima de 272 mil tokens
Aqui a história muda bastante
O Fugu Ultra v2 tem duas faixas, e a segunda dispara
| Faixa de contexto | Input ($/M) | Output ($/M) | Input em cache ($/M) |
|---|---|---|---|
| Até 272 mil tokens | $5 | $30 | $0,50 |
| Acima de 272 mil tokens | $10 | $45 | $1,00 |
Repare que não é só a saída que sobe: entrada, saída e cache aumentam juntos quando o contexto passa do corte
O preço de $5/$30 também aparece na listagem do Fugu Ultra v2 no OpenRouter, então não é número de uma fonte só
Tome cuidado com esse limiar!
A janela do Ultra v2 é de 1 milhão de tokens e ele gera até 128 mil tokens de completion
Traduzindo: o modelo aceita MUITO mais contexto do que os 272 mil do corte de faixa
Dá pra passar do limiar sem perceber, principalmente em agente que vai empilhando histórico de conversa e arquivos no prompt a cada iteração
O Fugu Max não tem esse problema, porque mantém $2/$6 em qualquer comprimento de contexto
Quando escolher o Fugu Max e quando o Fugu Ultra v2 compensa
Vamos aos cenários concretos, só com os números que existem na mesa
1. Carga pesada de geração de texto ou código
É o caso mais óbvio do Fugu Max
A saída dele é $6 por milhão contra $30 do Ultra v2
Isso é 5x de diferença no lugar exato onde o seu uso gasta mais
2. Prompt gigante com reuso de contexto
Aqui o Ultra v2 tem uma carta que o Max não mostrou: entrada em cache a $0,50 por milhão
Se o seu fluxo manda o mesmo bloco enorme de contexto várias vezes seguidas, essa linha muda a conta
Não existe faixa de cache divulgada para o Fugu Max, então não dá pra fazer essa comparação de forma honesta
Quando o dado não existe, o certo é dizer que não existe, e não chutar
3. Trabalho acima de 272 mil tokens de contexto
Nesse cenário o Ultra v2 muda de faixa e passa a $10/$45
O Max segue nos mesmos $2/$6
Se o seu caso vive em contexto longo por natureza, o desenho de preço favorece o Max de forma bem direta
4. Migração de quem já paga output de Sonnet 5, GPT 5.6 Terra ou Kimi K3
Como o input do Max empata com dois desses três, a decisão vira uma pergunta única: quanto do seu gasto é saída?
Se for a maior parte, a economia aparece
Se for pouco, a mudança rende bem menos do que a manchete de 40% a 60% sugere
Quando a diferença no output realmente muda a sua conta
Bora fazer a conta na prática?
Imagina um mês com 10 milhões de tokens de entrada e 1 milhão de saída, aquele uso de classificação e extração, que lê muito e escreve pouco
- Fugu Max: 10 × $2 + 1 × $6 = $26
- Claude Sonnet 5: 10 × $2 + 1 × $10 = $30
- GPT 5.6 Terra: 10 × $2 + 1 × $12 = $32
Perceba: a diferença ficou pequena, porque o input é $2 por milhão nos três e é ele que domina a fatura nesse perfil
Agora inverte o workload: 1 milhão de entrada e 10 milhões de saída, aquele uso de gerar código, documentação e relatório
- Fugu Max: 1 × $2 + 10 × $6 = $62
- Claude Sonnet 5: 1 × $2 + 10 × $10 = $102
- GPT 5.6 Terra: 1 × $2 + 10 × $12 = $122
- Kimi K3: 1 × $3 + 10 × $15 = $153
É o MESMO preço de tabela nos dois exemplos, e o resultado é completamente diferente
A economia de 40% a 60% não é um desconto que cai na sua fatura por decreto, ela é a sua proporção entre entrada e saída
E tem a rota da assinatura, que a Sakana também oferece
São três planos mensais: Standard a $20, Pro a $100 (10x o uso do Standard) e Max a $200 (20x o uso do Standard), além do pay-as-you-go cobrado por token
Atenção num ponto: a página de planos fala em acesso a Fugu e Fugu Ultra, sem citar o Fugu Max, então não dá pra afirmar aqui que o Max entra nesses planos
A orientação prática é sempre a mesma: estime seus tokens de SAÍDA por mês antes de escolher entre plano fixo e uso avulso
É o mesmo exercício de quando você compara assinatura contra custo por dev em qualquer ferramenta de IA: o número de uso real decide, não o preço da manchete
Vale a pena pelo preço?
Veredito curto e honesto
O Fugu Max tem o preço de saída mais baixo dessa comparação e é o único dos dois sem faixa extra por contexto longo
Isso favorece de forma clara quem gera muito token e quem trabalha com prompts grandes
O Fugu Ultra v2 cobra 5x mais no output e só se justifica quando o preço de entrada em cache a $0,50 por milhão e a orquestração mais pesada fizerem diferença real no seu fluxo
Agora o limite, que precisa ficar explícito: os ganhos de qualidade citados pela Sakana saem da página oficial de lançamento e não foram verificados de forma independente aqui
Preço baixo em tabela não é o mesmo que resultado bom no seu código
Tabela você compara em cinco minutos, qualidade só no seu próprio caso de uso 😀
Vídeo: IA de programar grátis com 1 milhão de contexto
Pra começar do zero no assunto de modelos com 1 milhão de tokens de contexto, este vídeo do canal mostra o MiMo Code, uma IA de programar gratuita, sem login e com 1 milhão de contexto
Bom ponto de partida antes de decidir onde você vai colocar seu dinheiro de API
Conclusão
Recapitulando os dois preços
O Fugu Max custa $2 por milhão de tokens de entrada e $6 por milhão de saída, o mesmo valor em qualquer comprimento de contexto
O Fugu Ultra v2 custa $5 de entrada e $30 de saída por milhão, com $0,50 por milhão de entrada em cache, e sobe para $10/$45/$1,00 acima de 272 mil tokens de contexto
O próximo passo prático é bem chato e bem necessário: levante quantos tokens de SAÍDA o seu uso consome por mês
Converta com o câmbio de R$ 5,09, compare com os planos mensais e só então decida se migrar faz sentido
Preço por milhão só vira economia de verdade depois que você conhece o seu próprio volume…
Segue por aqui que tem mais conteúdo sobre ferramentas de IA chegando, até o próximo post! =)
Perguntas frequentes
Quanto custa o Fugu Max por milhão de tokens de entrada e saída?
O Fugu Max custa $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída, e o câmbio canônico deste post é R$ 5,09. Esse preço vale para qualquer tamanho de contexto, sem faixa extra para prompt longo.
Qual a diferença de preço entre o Fugu Max e o Fugu Ultra v2?
O Fugu Max cobra $2/$6 por milhão de tokens de entrada e saída, enquanto o Fugu Ultra v2 cobra $5/$30 até 272 mil tokens de contexto. Acima desse limiar, o Ultra v2 sobe para $10/$45, algo que nunca acontece com o Fugu Max.
O Fugu Ultra v2 tem desconto para input em cache?
Sim, o Fugu Ultra v2 cobra $0,50 por milhão de tokens de entrada em cache dentro da faixa até 272 mil tokens, e $1,00 por milhão acima desse limiar. O Fugu Max não tem preço de cache divulgado, então essa comparação não dá pra fazer.
Quais são os planos de assinatura mensais da Sakana?
A Sakana oferece assinatura Standard por $20 por mês, Pro por $100 por mês (10x o uso do Standard) e Max por $200 por mês (20x o uso do Standard), além de um plano pay-as-you-go cobrado por token, que é a tabela de preço usada neste post. A página de planos cita acesso a Fugu e Fugu Ultra, sem mencionar o Fugu Max, então não dá pra afirmar que o Max está incluído nessas assinaturas.
O preço do Fugu Max muda em prompts muito longos?
Não, o Fugu Max mantém $2 de entrada e $6 de saída por milhão de tokens em qualquer comprimento de contexto, até o limite de 1 milhão de tokens da janela. Isso é diferente do Fugu Ultra v2, que muda de faixa acima de 272 mil tokens.
Onde consigo confirmar o preço do Fugu Ultra v2 além da página da Sakana?
O valor de $5 por milhão de entrada e $30 por milhão de saída do Fugu Ultra v2 também aparece na listagem do OpenRouter, batendo com o número divulgado pela Sakana AI. Isso dá mais segurança de que o preço da faixa padrão está correto.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
O que significa “ChatGPT network error” e como resolver
O “ChatGPT Network Error” é uma ocorrência frequente na rotina de muitos usuários do ChatGPT. Porém, poucos compreendem seu significado, quando esse erro surge, etc. […]

Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação
Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação A popularidade da automação de processos com o n8n está em alta, principalmente […]

Como usar o Antigravity do Google: guia completo do zero ao primeiro app
Aprenda neste guia prático como usar o Antigravity do Google: descubra a instalação, configuração, criação de projetos com o Agent Manager e o primeiro deploy, […]
