Claude Fable 5 vale a pena? Quando ele compensa e quando é caro demais para a tarefa

comparação de preço do Claude Fable 5 com Opus 5 e Haiku 4.5
Resposta rápida

O Claude Fable 5 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída, contra US$ 5/US$ 25 do Opus 5 e US$ 1/US$ 5 do Haiku 4.5. A Anthropic posiciona ele como modelo de nível Mythos, feito para projetos longos e ambiciosos, capaz de trabalhar por dias em um harness de agente como o Claude Code, planejando em etapas e checando o próprio trabalho. Então a conta fecha em tarefa longa, ambígua e multi-etapas. Em prompt curto e repetitivo, você paga saída cara por um planejamento que nem usou

Fala aí, beleza? O Claude Fable 5 é o modelo mais capaz da linha e também o mais caro por token, e é exatamente por isso que a pergunta "ele é bom?" não leva a lugar nenhum

A pergunta certa é outra: esta tarefa aqui justifica o preço dele?

A própria Anthropic posiciona o Fable 5 como um modelo de nível Mythos, feito para projetos longos e ambiciosos, que rodando dentro de um harness de agente como o Claude Code consegue trabalhar por dias, planejando em etapas, delegando pra subagentes e checando o próprio trabalho

Isso já é meio caminho da resposta

Se o teu pedido cabe em três linhas e tem resposta previsível, tu tá pagando por uma capacidade que nem entra em campo

Este post não é recomendação genérica do tipo "use o melhor modelo", é um roteiro de decisão com critério objetivo: preço na mesa, perfil do modelo na mesa, e tu decide 😀

Preço do Claude Fable 5 comparado com Opus 5, Sonnet 5 e Haiku 4.5

Antes de qualquer papo de capacidade, olha os números de API por milhão de tokens (MTok):

Modelo Entrada (US$/MTok) Saída (US$/MTok)
Claude Fable 5 10 50
Claude Opus 5 5 25
Claude Sonnet 5 (introdutório, até 31/08/2026) 2 10
Claude Sonnet 5 (a partir de 01/09/2026) 3 15
Claude Haiku 4.5 1 5

E os limites técnicos do Fable 5, que importam pra decisão:

Característica Fable 5
Janela de contexto 1 milhão de tokens (padrão)
Teto de saída por requisição 128 mil tokens
Entradas aceitas texto, imagem e arquivos
Saída texto, com suporte a raciocínio
Identificador na API claude-fable-5
Formação Vibe Coding
Formação Recomendada

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Onde a diferença realmente dói:

Repara que a distância maior não está na entrada, está na saída

US$ 50 por milhão de tokens de saída contra US$ 5 do Haiku 4.5, ou seja, dez vezes

E saída é justamente onde um modelo agente gasta: ele escreve plano, escreve código, escreve o diff, escreve o resumo do que fez, corrige, escreve de novo

Outro dado que fecha o cerco: o preço do Fable 5 continua igual ao do lançamento, sem redução até agosto de 2026

Ou seja, não adianta esperar sentado uma promoção pra resolver a conta, a decisão é por tarefa mesmo

Se a tua dor é o custo geral da ferramenta e não só deste modelo, eu já destrinchei o preço do Claude Code em 2026 em outro post

Quando o Claude Fable 5 compensa

Aqui vão os critérios, sem adjetivo, sem "use quando for importante"

O Fable 5 se paga quando a tarefa tem pelo menos duas destas características:

  • Atravessa muitos arquivos e muitas etapas, com dependência entre elas (mexeu aqui, quebra ali, precisa voltar)
  • Escopo ambíguo, do tipo que exige planejar antes de escrever a primeira linha de código
  • Roda por horas ou dias em harness de agente, que é o cenário que a Anthropic descreve pro nível Mythos: planejar em etapas, delegar pra subagentes, checar o próprio trabalho
  • Precisa de contexto grande, aproveitando de verdade a janela de 1 milhão de tokens
  • Precisa de saída longa, chegando perto do teto de 128 mil tokens por requisição
  • Entrada mista, porque ele aceita texto, imagem e arquivos na mesma jogada

E tem o sinal de capacidade vindo de avaliador terceiro: a Vals AI aponta 95,00% no SWE-bench Verified pro Fable 5

Que benchmark é esse? São 500 tarefas montadas em cima de issues reais do GitHub, cada uma rodando em container Docker isolado

Ou seja, não é pergunta de prova, é problema de repositório de verdade, o que casa bem com o perfil de trabalho longo

Quando ele é caro demais para a tarefa

Agora o outro lado, que é onde a maioria das pessoas queima crédito sem perceber

O Fable 5 é caro demais quando:

  • O prompt é curto e a resposta é previsível (formatar um texto, gerar um commit message, responder uma dúvida pontual)
  • É classificação ou extração em volume, aquele trabalho de moer milhares de itens com o mesmo formato de saída
  • É refactor mecânico já especificado, do tipo "renomeia isso em todos os arquivos e ajusta o import"
  • É geração repetitiva de texto padrão, com molde definido
  • São chamadas de alta frequência em produção, onde o custo multiplica por requisição e a latência conta

A régua prática é essa, e ela é bem simples:

Se tu já sabe o passo a passo antes de pedir, o planejamento autônomo não vai ser usado

E aí tu tá pagando saída premium por um trabalho que um nível mais barato entrega igual

Tome cuidado com um detalhe: nem toda pergunta vai ser respondida pelo Fable 5 mesmo quando tu escolhe ele

As salvaguardas redirecionam consultas em áreas de alto risco (cibersegurança e biologia, por exemplo) pro Claude Opus 4.8

Então, se teu caso vive nessas áreas, contar com o Fable 5 como padrão pode não fazer sentido nenhum

Pra escolher o nível certo tarefa a tarefa, eu já escrevi sobre qual modelo usar no Claude Code e quando o mais barato já resolve

O que apareceu no teste prático

Quando testei o modelo, rodei duas frentes na mesma sessão: uma simulação de trânsito de cidade em arquivo único pela interface web, e um sistema web completo pelo Claude Code

A simulação ficou pronta em menos de 10 minutos e em 1 interação

Malha de ruas vista de cima, semáforos, carros se movendo e respeitando o cruzamento

O defeito? A visualização saiu pequena demais na tela, sem zoom, e precisaria de mais uma rodada de ajuste pra ficar confortável de olhar

No Claude Code, o sistema web saiu em cerca de 15 minutos e subiu na porta 3001

Veio com autenticação por e-mail e senha, kanban com drag and drop funcionando, dashboard com gráficos e dados de exemplo já carregados, tudo numa tentativa só

Sendo honesto: eu não testei todas as funcionalidades desse sistema, só conferi que a aplicação subiu e que as telas principais respondiam

Teve reclamação também: eu pedi explicitamente um plano antes da execução, e ele escreveu o plano e emendou direto na execução, sem perguntar se podia seguir

E é aqui que o teste conversa com o preço

Poucas interações e uma execução longa em uma tacada só é EXATAMENTE o cenário em que o custo por token se dilui: tu paga saída cara uma vez em vez de pagar ida e volta dez vezes

O mesmo modelo em pedidos curtos e picados não teria essa vantagem, ia ser só conta alta

No vídeo abaixo eu mostro os dois projetos rodando na tela, do prompt até a aplicação de pé

Como baixar a conta sem trocar de tarefa

Dá pra reduzir bastante o custo sem abrir mão do modelo na etapa que importa

São quatro movimentos:

  1. Troque de modelo dentro da própria sessão do Claude Code com /model
/model

O comando abre um seletor interativo de modelos e níveis de esforço, e a troca vale imediatamente, preservando o histórico da conversa

Isso significa que tu pode planejar a arquitetura no modelo mais forte e descer de nível pra parte mecânica, sem perder o contexto do que já foi combinado

O erro comum deste passo: achar que precisa abrir sessão nova pra trocar de modelo, e com isso jogar fora todo o contexto que tu levou meia hora pra construir

  1. Aponte o modelo pelo identificador quando precisar ser explícito
/model claude-fable-5

O /model aceita alias ou nome completo do modelo

E na configuração model do Claude Code os formatos aceitos são: alias do modelo, nome do modelo, nome completo na Anthropic API, ARN de inference profile no Amazon Bedrock, nome de deployment no Microsoft Foundry ou nome de versão no Agent Platform do Google Cloud

O erro comum deste passo: usar o formato de uma plataforma na outra (colar um ARN da Bedrock onde se espera o nome da Anthropic API, por exemplo) e ficar caçando o motivo do erro

  1. Use prompt caching no que se repete

Na plataforma Claude, leitura de cache custa 10% do preço padrão de entrada, ou seja, 90% de desconto em entradas repetidas

No Fable 5 os valores são estes: cache hit US$ 1/MTok, escrita de cache de 5 minutos US$ 12,50/MTok e escrita de cache de 1 hora US$ 20/MTok

Repara que escrever cache custa MAIS caro que a entrada normal (US$ 12,50 contra US$ 10)

O erro comum deste passo: escrever cache pra prompt que não se repete

Se o conteúdo vai ser lido uma vez só, tu pagou o prêmio da escrita e nunca colheu o desconto da leitura

  1. Mande pra Batch API tudo que não é interativo

A Batch API dá 50% de desconto em entrada e saída

Relatório noturno, varredura de repositório, processamento de fila: tudo isso pode esperar

O erro comum deste passo: mandar pro batch algo que precisa de resposta na hora, e travar teu próprio fluxo de trabalho pra economizar uns centavos

Veredito: para quem o Fable 5 se paga

O Fable 5 se paga pra quem roda trabalho agente longo e ambíguo, e mede resultado por tarefa concluída, não por chamada de API

Se a métrica da tua cabeça é "quanto custou este prompt", ele vai parecer caro sempre

Se a métrica é "quanto custou entregar esta feature de ponta a ponta", a conta muda de figura, porque menos ida e volta significa menos contexto reprocessado

O que ele NÃO é: modelo padrão pra tudo

Deixar ele ligado como default e disparar pergunta de duas linhas é a forma mais rápida de torrar orçamento sem entregar nada diferente

E se eu não uso API?

Dá pra chegar nele pela assinatura também

No anúncio de lançamento, a Anthropic listou Pro, Max, Team e Enterprise como público de assinatura contemplado

Só que isso mudou depois: desde 20 de julho de 2026, o Fable 5 está incluído em todos os planos Max e Team Premium, consumindo até 50% do limite semanal de uso, sem custo extra

Pro e Team Standard passaram a acessar por usage credits pay-as-you-go, com um crédito único de US$ 100

Esse arranjo novo é permanente, valendo depois do fim da promoção em 19/07/2026

Sobre onde ele roda: a disponibilidade geral é desde 9 de junho de 2026, na Claude API, Amazon Bedrock, Claude Platform na AWS, Google Cloud e Microsoft Foundry

Conclusão

O critério cabe em uma frase: quem decide é o tamanho e a ambiguidade da tarefa, não o hype do modelo

Tarefa longa, multi-arquivo e mal definida é onde o Fable 5 foi construído pra atuar

Tarefa curta, repetitiva e já especificada é onde ele vira desperdício de saída cara

E o próximo passo é bem concreto, não precisa de fórmula mágica nenhuma:

Pega UMA tarefa longa de verdade do teu projeto (dessas que tu adia porque dá preguiça de começar)

Roda com /model no Fable 5 e anota o tempo e o resultado

Depois roda a mesma tarefa em um nível mais barato

Aí tu decide com número na mão, e não com opinião de post na internet (nem a minha, haha)

Segue testando e me conta como foi, até o próximo post! 🙂

Perguntas frequentes

Quanto custa o Claude Fable 5 por milhão de tokens na API?

O Fable 5 cobra US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. Esse valor é o mesmo desde o lançamento, sem redução até agosto de 2026. A diferença mais pesada fica na saída, que custa dez vezes mais que o Haiku 4.5.

O Claude Fable 5 está incluído na assinatura Pro ou só em planos mais caros?

Isso mudou desde o lançamento. Desde 20 de julho de 2026, o Fable 5 está incluído em todos os planos Max e Team Premium, consumindo até 50% do limite semanal de uso sem custo extra. Já quem está no Pro ou no Team Standard acessa por usage credits pay-as-you-go, com um crédito único de US$ 100, e esse arranjo passou a valer de forma permanente após o fim da promoção em 19/07/2026.

Qual o limite de contexto e de saída do Claude Fable 5?

O Fable 5 trabalha com 1 milhão de tokens de contexto por padrão e permite até 128 mil tokens de saída por requisição. Isso é o que sustenta o uso em tarefas longas, que precisam carregar muito material e ainda gerar respostas extensas. Ele também aceita texto, imagem e arquivos como entrada.

Como trocar para o Claude Fable 5 no meio de uma sessão do Claude Code?

É só usar o comando /model, que abre um seletor interativo de modelos e níveis de esforço. Ele aceita tanto o alias quanto o nome completo do modelo, e o identificador do Fable 5 na API é claude-fable-5. A troca vale imediatamente e o histórico da conversa é preservado.

O Claude Fable 5 responde perguntas de cibersegurança e biologia?

Nem sempre com o próprio Fable 5. As salvaguardas do modelo redirecionam consultas em áreas de alto risco, como cibersegurança e biologia, para o Claude Opus 4.8. Então, se o teu caso de uso vive nessas áreas, contar com o Fable 5 como padrão pode não fazer sentido.

Em quais plataformas o Claude Fable 5 está disponível hoje?

O Fable 5 está disponível de forma geral desde 9 de junho de 2026 na Claude API, na Amazon Bedrock, na Claude Platform na AWS, no Google Cloud e no Microsoft Foundry. No anúncio de lançamento, o acesso via assinatura contemplou usuários Pro, Max, Team e Enterprise, mas essa regra mudou depois: desde 20 de julho de 2026 vale o arranjo em que Max e Team Premium têm o modelo incluído e Pro e Team Standard acessam por usage credits. A configuração do modelo aceita alias, nome completo na API da Anthropic, ARN de inference profile no Bedrock, nome de deployment no Microsoft Foundry ou nome de versão no Agent Platform do Google Cloud.




Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação SAAS com IA

Formação SAAS com IA

Tire usas ideias do papel criando softwares com IA, integre pagamentos e lance seu projeto!

  • 291 aulas
  • 18 projetos
  • 24h 17min

Blog | Mais populares