Claude Fable 5.1 vs Claude Fable 5: o que muda na prática?

O Claude Fable 5.1 estende o Fable 5 sem mexer no preço: US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída nos dois. O que muda é a leitura de cache, que caiu de US$ 1,00 para US$ 0,25 por milhão (75% mais barata), e o desempenho em programação agêntica de longa duração, pesquisa em várias etapas e trabalho com documentos, planilhas e slides. No Terminal-Bench-Science 0.1 ele saltou de 24,7% para 52,6%. O preço a pagar são três breaking changes que podem quebrar código que já roda
Uma atualização que não encosta no preço de entrada e saída, mas mexe justamente na linha que mais pesa na conta de quem roda agente o dia inteiro
Fala aí, beleza? A Anthropic anunciou o Claude Fable 5.1 e o Claude Mythos 5.1, e a divisão entre os dois é bem clara: o Fable 5.1 está disponível de forma geral, enquanto o Mythos 5.1 fica restrito a programas de acesso confiável para organizações verificadas de cibersegurança e ciências da vida
Então aqui a gente vai olhar só pro Fable, comparando as duas versões com o que a documentação e a página oficial do anúncio descrevem
Preço, benchmark, recursos novos e as breaking changes que podem pegar seu código de surpresa 🙂
Fable 5 x Fable 5.1: tabela de diferenças
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 116 aulas
- 4 projetos
- 9h 23min
Antes da conversa longa, o resumo lado a lado
| Item | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| Preço de entrada | US$ 10 por milhão de tokens | US$ 10 por milhão de tokens |
| Preço de saída | US$ 50 por milhão de tokens | US$ 50 por milhão de tokens |
| Leitura de cache | US$ 1,00 por milhão de tokens | US$ 0,25 por milhão de tokens |
| Terminal-Bench-Science 0.1 | 24,7% | 52,6% |
| Identificador na Claude API | linha só do 5.1 | claude-fable-5-1 |
| Janela de contexto | linha só do 5.1 | 1 milhão de tokens |
| Limite de saída | linha só do 5.1 | até 128 mil tokens |
| Adaptive thinking | linha só do 5.1 | ligado por padrão, esforço alto |
As linhas marcadas como "só do 5.1" são dados publicados pra esta versão
Preço igual, conta menor: como a leitura de cache mais barata muda o custo
Essa é a única mudança de preço da atualização, e ela é bem cirúrgica
Entrada continua em US$ 10 por milhão de tokens
Saída continua em US$ 50 por milhão de tokens
O que caiu foi a leitura de cache: de US$ 1,00 por milhão no Fable 5 pra US$ 0,25 por milhão no 5.1, ou seja, um quarto do custo anterior
Que leitura de cache? É o pedaço do prompt que o modelo já viu antes e não precisa processar de novo do zero. Se você conhece cache de aplicação web, a ideia é a mesma: o conteúdo repetido sai muito mais barato na segunda vez
Aí vem a pergunta óbvia: isso muda quanto na fatura de verdade?
A própria Anthropic estima cerca de 25% mais barato em cargas típicas, e até cerca de 45% em cargas altamente agênticas
A lógica por trás disso é simples: quanto mais você reusa contexto, maior a fatia da sua conta que vem de leitura de cache
Agente longo relê instrução, relê arquivo, relê histórico o tempo todo
Quem manda uma pergunta solta e vai embora quase não sente
Quem roda pipeline de horas sente MUITO
O que melhorou em desempenho segundo as avaliações
Os ganhos declarados na atualização são três: programação agêntica de longa duração, pesquisa em várias etapas e trabalho com documentos, planilhas e slides
O número que mais chama atenção é o Terminal-Bench-Science 0.1, que avalia pesquisa científica agêntica
O Fable 5.1 fez 52,6% contra 24,7% do Fable 5
Mais que o dobro, se liga nisso
As duas versões 5.1 foram avaliadas em engenharia de software, raciocínio matemático e científico, contexto longo, busca agêntica e orquestração multiagente, tarefas multimodais e de uso de computador, trabalho profissional do mundo real e domínios multilíngue, de saúde e ciências da vida, superando Fable 5 e Mythos 5 na maioria das avaliações
E os maiores ganhos ficaram concentrados em trabalho científico e de engenharia no terminal, uso de computador e trabalho agêntico e profissional de longo horizonte
Repara no padrão: é tudo tarefa comprida, com muitas etapas, onde o modelo precisa aguentar o tranco sem se perder no meio do caminho
Modelo que roda por muito tempo sem alguém olhando também levanta a discussão sobre limites e supervisão de agentes, que é um papo que anda junto com esses ganhos de horizonte longo
Recursos novos que chegaram com o Fable 5.1
Aqui entram os aditivos, ou seja, coisas que apareceram sem quebrar o que já existia
- Esforço por mensagem (beta): permite mudar o nível de esforço no meio da conversa sem invalidar o cache de prompt
- Mensagens de sistema com escopo de turno (beta)
- Atualizações de progresso legíveis entre chamadas de ferramenta: o
display: "updates", em beta, com o header betathinking-display-updates-2026-08-18 - Preço menor de leitura de cache
- Proveniência de conteúdo
O esforço por mensagem é o que mais casa com o resto da atualização
Pensa: antes, mexer no nível de esforço no meio do papo tinha o efeito colateral de derrubar o cache
Agora dá pra subir e descer o esforço conforme a etapa da tarefa e continuar aproveitando o cache que ficou mais barato
Dois detalhes de comportamento padrão que vale saber antes de apontar seu código pra ele:
O Fable 5.1 vem com adaptive thinking habilitado por padrão em nível de esforço alto
E o texto gerado por Claude Fable 5.1 e Claude Mythos 5.1 carrega marca d’água estatística de texto da Anthropic em toda plataforma onde o modelo está disponível
As 3 breaking changes que podem quebrar seu código
Essa é a parte que eu leria duas vezes antes de trocar o identificador do modelo em produção
São três mudanças que quebram compatibilidade:
- Uso forçado de ferramenta (forced tool use) retorna erro
- Modelos anteriores não conseguem ler os blocos de thinking dele
- Editar turnos anteriores invalida os blocos de thinking
A primeira é a mais afiada, porque forced tool use é padrão comum em pipeline que precisa de saída garantida em formato de ferramenta
A segunda pega quem faz roteamento entre modelos, passando histórico de um pro outro
A terceira pega quem reescreve turno anterior pra corrigir contexto no meio da execução
Tome cuidado! O caminho é mapear onde seu código faz essas três coisas antes de migrar
Quando vale trocar do Fable 5 para o 5.1 (e quando tanto faz)
Os cenários em que a troca se paga sozinha:
- Pipeline agêntico longo: é onde a estimativa de até cerca de 45% de economia aparece, e é justamente a área de maior ganho declarado
- Carga com muito reuso de contexto: se boa parte dos seus tokens é releitura de prompt cacheado, o preço a um quarto muda a conta na hora
- Pesquisa em várias etapas: o salto de 24,7% pra 52,6% no Terminal-Bench-Science 0.1 é o dado mais direto nesse sentido
- Trabalho com documentos, planilhas e slides: entra na lista oficial de melhorias
E o contraponto, porque nem tudo é festa:
Se a sua carga usa pouco cache, a economia vira quase nada, já que entrada e saída seguem no mesmo preço
E se ela depende de forced tool use, você não tem só uma troca de string de modelo pela frente, você tem trabalho de migração
Nesse caso, decidir com calma é mais barato que decidir rápido
Onde usar: plataformas, identificador e tempo de vida do modelo
Na Claude API o identificador do modelo é claude-fable-5-1
E o Claude Fable 5.1 está disponível em Claude API, Amazon Bedrock, Claude Platform na AWS, Google Cloud e Microsoft Foundry
Se você já pensou na questão de rodar o mesmo modelo em provedores diferentes, a lógica continua valendo aqui, só muda o identificador que você aponta
Sobre tempo de vida: o modelo não está previsto para ser aposentado antes de 1 de setembro de 2027
Ou seja, dá pra construir em cima dele sem aquele frio na barriga de deprecação em três meses
Vale a atualização? Nosso veredito
É uma atualização de baixo atrito no bolso e de atrito médio no código
No bolso, porque entrada e saída ficaram idênticas e a única mudança de preço foi pra baixo, com a leitura de cache a um quarto do custo e a estimativa oficial de cerca de 25% em cargas típicas e até cerca de 45% nas altamente agênticas
No código, porque as três breaking changes são reais e batem justamente em padrões populares: forced tool use e manipulação de histórico com blocos de thinking
Se o seu projeto não usa nenhum dos dois, a troca fica perto de só mudar a string do modelo
Se usa, tem trabalho de migração no meio do caminho, e é ele que define se a conta menor compensa agora ou daqui a um mês
O salto no benchmark científico agêntico é o argumento mais forte a favor: 52,6% contra 24,7% não é ajuste fino, é outra faixa de resultado
Importante deixar claro: essa análise se apoia nos dados oficiais publicados sobre o modelo, sem teste próprio aqui do lado
Então trate os números como ponto de partida da sua avaliação, não como substituto dela
Conclusão: o próximo passo
A lógica do Fable 5.1 cabe em uma linha: preço de entrada e saída igual, leitura de cache muito mais barata e ganho declarado em trabalho agêntico longo, pesquisa multietapa e documentos, planilhas e slides
Quanto mais a sua carga parece com um agente rodando por horas em cima do mesmo contexto, mais essa combinação te favorece
O próximo passo prático não é trocar o modelo, é abrir seu código e procurar duas coisas: uso forçado de ferramenta e qualquer lugar onde você edita turnos anteriores ou repassa blocos de thinking entre modelos
Resolvido isso, aí sim é só apontar pra claude-fable-5-1 na plataforma que você já usa
até o próximo post! 😀
Perguntas frequentes
Claude Fable 5.1 é mais caro que o Fable 5?
Não no que é cobrado por token de entrada e saída. O Fable 5.1 mantém US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída, exatamente igual ao Fable 5. A única mudança de preço foi pra baixo, na leitura de cache, que caiu pra US$ 0,25 por milhão de tokens.
Qual é o identificador do Claude Fable 5.1 na API da Anthropic?
O identificador do modelo na Claude API é claude-fable-5-1. É esse o valor que entra no campo de modelo das suas chamadas pra apontar pro Fable 5.1.
Em quais plataformas dá pra usar o Claude Fable 5.1?
O modelo está disponível na Claude API, no Amazon Bedrock, na Claude Platform na AWS, no Google Cloud e no Microsoft Foundry. Ou seja, não fica preso a um único provedor de nuvem.
Qual o tamanho da janela de contexto do Fable 5.1?
A janela de contexto vai até 1 milhão de tokens, com limite de saída de até 128 mil tokens. Isso ajuda justamente nos casos de uso que a atualização reforça, como pesquisa em várias etapas e trabalho com documentos longos.
Quando o Claude Fable 5.1 vai ser aposentado?
Segundo a Anthropic, o modelo não está previsto pra ser aposentado antes de 1 de setembro de 2027. Dá uma boa margem pra planejar migração de projeto sem pressa.
Dá pra usar forced tool use com o Fable 5.1?
Não, essa é uma das breaking changes da versão. No Fable 5.1, o uso forçado de ferramenta (forced tool use) retorna erro, então pipeline que dependia disso pra garantir saída em formato de ferramenta precisa ser revisado antes da migração.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Claude Fable 5 tem 1 milhão de tokens de contexto: o que cabe nessa janela?
Claude Fable 5 1 milhão de tokens: veja o que cabe na janela de contexto, os limites de saída e como acompanhar o uso no Claude Code com /context.
Vale a pena manter Fable 5.1 e GPT-6 Astra ao mesmo tempo ou escolher um só?
Fable 5.1 ou GPT-6 Astra: no preço empatam, mas cache, batch, modo Fast e sobretaxa mudam a conta real. Veja se vale manter os dois ou escolher só um.
Dá para voltar ao Claude Fable 5 se o 5.1 não se sair bem no seu fluxo?
Dá para voltar ao Claude Fable 5 se o 5.1 não funcionar no seu fluxo? Veja como reverter com segurança, riscos do tool_choice e prazo de aposentadoria.
