Quanto custa o Fugu Max e o Fugu Ultra v2 por milhão de tokens?

comparação do preço do Fugu Max e do Fugu Ultra v2 por milhão de tokens
Resposta rápida

Fugu Max preço, direto ao ponto: 2 dólares por milhão de tokens de entrada e 6 dólares por milhão de tokens de saída, sem faixa mais cara para contexto longo (cerca de R$ 10,18 e R$ 30,54 no câmbio de R$ 5,09). Já o Fugu Ultra v2 custa 5 dólares de entrada e 30 dólares de saída por milhão, com 0,50 dólar por milhão de entrada em cache, e sobe para 10 e 45 dólares acima de 272 mil tokens de contexto. A própria Sakana AI diz que o output do Max sai de 40% a 60% mais barato que Sonnet 5, GPT 5.6 Terra e Kimi K3

Fala aí, beleza? Quem paga API sabe que a conta não estoura na entrada, ela estoura na SAÍDA

E é exatamente aí que a Sakana AI resolveu atacar

Em 10 de setembro de 2026 ela anunciou o Fugu Max e o Fugu Ultra v2, duas variantes de orquestração do sistema multiagente Fugu

O detalhe que confunde todo mundo: apesar de virem no mesmo anúncio, os dois NÃO compartilham a mesma tabela de preço

Cada um tem a sua, e a distância entre elas é grande

O que são o Fugu Max e o Fugu Ultra v2

Os dois são variantes de orquestração do Fugu, o sistema multiagente da Sakana AI

Orquestração aqui significa o seguinte: em vez de um modelo único mastigando tudo sozinho, existe uma camada que decide qual modelo do time recebe cada tarefa

Se você já usou um gerenciador de pacotes tipo NPM ou composer, a lógica de "tem uma camada resolvendo pra você o que puxar de onde" é bem parecida, só que aqui o que se resolve é qual modelo responde

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 116 aulas
  • 4 projetos
  • 9h 23min

O Fugu Max roteia cada tarefa para o modelo mais leve capaz de resolvê-la

E ele também amplia o conjunto de modelos que o Fugu orquestra, incluindo modelos de pesos abertos e a família NVIDIA Nemotron

A página de lançamento da Sakana AI afirma que o Fugu Max expande a fronteira de Pareto de custo e desempenho em 7 de 10 benchmarks

Aqui vale o aviso: isso é alegação da página oficial, não foi verificada de forma independente neste post

Número de benchmark de página de lançamento é sempre o melhor cenário possível do fabricante, beleza? 🙂

Os dois modelos têm janela de 1 milhão de tokens de contexto e geram até 128 mil tokens de saída por resposta

Fugu Max vs Sonnet 5, GPT 5.6 Terra e Kimi K3: a comparação de preço

Essa é a tabela que interessa

Modelo Input ($/M) Output ($/M)
Fugu Max $2 $6
Claude Sonnet 5 $2 $10
GPT 5.6 Terra $2 $12
Kimi K3 $3 $15

Se você quiser converter pra real, o câmbio canônico deste post é R$ 5,09 (abertura de 11/09/2026)

A faixa de 40% a 60% mais barato no output que a Sakana anuncia bate certinho com esses números

Contra o Sonnet 5, sair de $10 para $6 é 40% a menos

Contra o GPT 5.6 Terra, a saída cai de $12 para $6

Contra o Kimi K3, de $15 para $6 é 60%

Ou seja: a ponta de baixo e a ponta de cima da promessa oficial são exatamente esses três concorrentes

Agora se liga no que a tabela mostra de mais importante

O input do Fugu Max EMPATA com Sonnet 5 e GPT 5.6 Terra: $2 por milhão nos três

A diferença toda mora na saída, em nenhum outro lugar

Sobre o Sonnet 5, um detalhe que muita gente ainda erra: o $2/$10 era promocional até 31 de agosto de 2026 e virou o preço padrão, o aumento para $3/$15 não aconteceu

E tem mais um ponto a favor do Max: o preço é o mesmo em qualquer tamanho de contexto

Não existe faixa mais cara pra prompt longo

Se você já fez esse tipo de conta antes pra outro modelo, o raciocínio é o mesmo de calcular o gasto de API: estime volume, separe entrada de saída, e só depois converta

Fugu Ultra v2: preço padrão e a faixa acima de 272 mil tokens

Aqui a história muda bastante

O Fugu Ultra v2 tem duas faixas, e a segunda dispara

Faixa de contexto Input ($/M) Output ($/M) Input em cache ($/M)
Até 272 mil tokens $5 $30 $0,50
Acima de 272 mil tokens $10 $45 $1,00

Repare que não é só a saída que sobe: entrada, saída e cache aumentam juntos quando o contexto passa do corte

O preço de $5/$30 também aparece na listagem do Fugu Ultra v2 no OpenRouter, então não é número de uma fonte só

Tome cuidado com esse limiar!

A janela do Ultra v2 é de 1 milhão de tokens e ele gera até 128 mil tokens de completion

Traduzindo: o modelo aceita MUITO mais contexto do que os 272 mil do corte de faixa

Dá pra passar do limiar sem perceber, principalmente em agente que vai empilhando histórico de conversa e arquivos no prompt a cada iteração

O Fugu Max não tem esse problema, porque mantém $2/$6 em qualquer comprimento de contexto

Quando escolher o Fugu Max e quando o Fugu Ultra v2 compensa

Vamos aos cenários concretos, só com os números que existem na mesa

1. Carga pesada de geração de texto ou código

É o caso mais óbvio do Fugu Max

A saída dele é $6 por milhão contra $30 do Ultra v2

Isso é 5x de diferença no lugar exato onde o seu uso gasta mais

2. Prompt gigante com reuso de contexto

Aqui o Ultra v2 tem uma carta que o Max não mostrou: entrada em cache a $0,50 por milhão

Se o seu fluxo manda o mesmo bloco enorme de contexto várias vezes seguidas, essa linha muda a conta

Não existe faixa de cache divulgada para o Fugu Max, então não dá pra fazer essa comparação de forma honesta

Quando o dado não existe, o certo é dizer que não existe, e não chutar

3. Trabalho acima de 272 mil tokens de contexto

Nesse cenário o Ultra v2 muda de faixa e passa a $10/$45

O Max segue nos mesmos $2/$6

Se o seu caso vive em contexto longo por natureza, o desenho de preço favorece o Max de forma bem direta

4. Migração de quem já paga output de Sonnet 5, GPT 5.6 Terra ou Kimi K3

Como o input do Max empata com dois desses três, a decisão vira uma pergunta única: quanto do seu gasto é saída?

Se for a maior parte, a economia aparece

Se for pouco, a mudança rende bem menos do que a manchete de 40% a 60% sugere

Quando a diferença no output realmente muda a sua conta

Bora fazer a conta na prática?

Imagina um mês com 10 milhões de tokens de entrada e 1 milhão de saída, aquele uso de classificação e extração, que lê muito e escreve pouco

  • Fugu Max: 10 × $2 + 1 × $6 = $26
  • Claude Sonnet 5: 10 × $2 + 1 × $10 = $30
  • GPT 5.6 Terra: 10 × $2 + 1 × $12 = $32

Perceba: a diferença ficou pequena, porque o input é $2 por milhão nos três e é ele que domina a fatura nesse perfil

Agora inverte o workload: 1 milhão de entrada e 10 milhões de saída, aquele uso de gerar código, documentação e relatório

  • Fugu Max: 1 × $2 + 10 × $6 = $62
  • Claude Sonnet 5: 1 × $2 + 10 × $10 = $102
  • GPT 5.6 Terra: 1 × $2 + 10 × $12 = $122
  • Kimi K3: 1 × $3 + 10 × $15 = $153

É o MESMO preço de tabela nos dois exemplos, e o resultado é completamente diferente

A economia de 40% a 60% não é um desconto que cai na sua fatura por decreto, ela é a sua proporção entre entrada e saída

E tem a rota da assinatura, que a Sakana também oferece

São três planos mensais: Standard a $20, Pro a $100 (10x o uso do Standard) e Max a $200 (20x o uso do Standard), além do pay-as-you-go cobrado por token

Atenção num ponto: a página de planos fala em acesso a Fugu e Fugu Ultra, sem citar o Fugu Max, então não dá pra afirmar aqui que o Max entra nesses planos

A orientação prática é sempre a mesma: estime seus tokens de SAÍDA por mês antes de escolher entre plano fixo e uso avulso

É o mesmo exercício de quando você compara assinatura contra custo por dev em qualquer ferramenta de IA: o número de uso real decide, não o preço da manchete

Vale a pena pelo preço?

Veredito curto e honesto

O Fugu Max tem o preço de saída mais baixo dessa comparação e é o único dos dois sem faixa extra por contexto longo

Isso favorece de forma clara quem gera muito token e quem trabalha com prompts grandes

O Fugu Ultra v2 cobra 5x mais no output e só se justifica quando o preço de entrada em cache a $0,50 por milhão e a orquestração mais pesada fizerem diferença real no seu fluxo

Agora o limite, que precisa ficar explícito: os ganhos de qualidade citados pela Sakana saem da página oficial de lançamento e não foram verificados de forma independente aqui

Preço baixo em tabela não é o mesmo que resultado bom no seu código

Tabela você compara em cinco minutos, qualidade só no seu próprio caso de uso 😀

Vídeo: IA de programar grátis com 1 milhão de contexto

Pra começar do zero no assunto de modelos com 1 milhão de tokens de contexto, este vídeo do canal mostra o MiMo Code, uma IA de programar gratuita, sem login e com 1 milhão de contexto

Bom ponto de partida antes de decidir onde você vai colocar seu dinheiro de API

Conclusão

Recapitulando os dois preços

O Fugu Max custa $2 por milhão de tokens de entrada e $6 por milhão de saída, o mesmo valor em qualquer comprimento de contexto

O Fugu Ultra v2 custa $5 de entrada e $30 de saída por milhão, com $0,50 por milhão de entrada em cache, e sobe para $10/$45/$1,00 acima de 272 mil tokens de contexto

O próximo passo prático é bem chato e bem necessário: levante quantos tokens de SAÍDA o seu uso consome por mês

Converta com o câmbio de R$ 5,09, compare com os planos mensais e só então decida se migrar faz sentido

Preço por milhão só vira economia de verdade depois que você conhece o seu próprio volume…

Segue por aqui que tem mais conteúdo sobre ferramentas de IA chegando, até o próximo post! =)

Perguntas frequentes

Quanto custa o Fugu Max por milhão de tokens de entrada e saída?

O Fugu Max custa $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída, e o câmbio canônico deste post é R$ 5,09. Esse preço vale para qualquer tamanho de contexto, sem faixa extra para prompt longo.

Qual a diferença de preço entre o Fugu Max e o Fugu Ultra v2?

O Fugu Max cobra $2/$6 por milhão de tokens de entrada e saída, enquanto o Fugu Ultra v2 cobra $5/$30 até 272 mil tokens de contexto. Acima desse limiar, o Ultra v2 sobe para $10/$45, algo que nunca acontece com o Fugu Max.

O Fugu Ultra v2 tem desconto para input em cache?

Sim, o Fugu Ultra v2 cobra $0,50 por milhão de tokens de entrada em cache dentro da faixa até 272 mil tokens, e $1,00 por milhão acima desse limiar. O Fugu Max não tem preço de cache divulgado, então essa comparação não dá pra fazer.

Quais são os planos de assinatura mensais da Sakana?

A Sakana oferece assinatura Standard por $20 por mês, Pro por $100 por mês (10x o uso do Standard) e Max por $200 por mês (20x o uso do Standard), além de um plano pay-as-you-go cobrado por token, que é a tabela de preço usada neste post. A página de planos cita acesso a Fugu e Fugu Ultra, sem mencionar o Fugu Max, então não dá pra afirmar que o Max está incluído nessas assinaturas.

O preço do Fugu Max muda em prompts muito longos?

Não, o Fugu Max mantém $2 de entrada e $6 de saída por milhão de tokens em qualquer comprimento de contexto, até o limite de 1 milhão de tokens da janela. Isso é diferente do Fugu Ultra v2, que muda de faixa acima de 272 mil tokens.

Onde consigo confirmar o preço do Fugu Ultra v2 além da página da Sakana?

O valor de $5 por milhão de entrada e $30 por milhão de saída do Fugu Ultra v2 também aparece na listagem do OpenRouter, batendo com o número divulgado pela Sakana AI. Isso dá mais segurança de que o preço da faixa padrão está correto.




Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares