Claude Fable 5.1 vs Claude Fable 5: o que muda na prática?

Claude Fable 5.1 comparado ao Claude Fable 5 em tarefas de código e pesquisa agêntica
Resposta rápida

O Claude Fable 5.1 estende o Fable 5 sem mexer no preço: US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída nos dois. O que muda é a leitura de cache, que caiu de US$ 1,00 para US$ 0,25 por milhão (75% mais barata), e o desempenho em programação agêntica de longa duração, pesquisa em várias etapas e trabalho com documentos, planilhas e slides. No Terminal-Bench-Science 0.1 ele saltou de 24,7% para 52,6%. O preço a pagar são três breaking changes que podem quebrar código que já roda

Uma atualização que não encosta no preço de entrada e saída, mas mexe justamente na linha que mais pesa na conta de quem roda agente o dia inteiro

Fala aí, beleza? A Anthropic anunciou o Claude Fable 5.1 e o Claude Mythos 5.1, e a divisão entre os dois é bem clara: o Fable 5.1 está disponível de forma geral, enquanto o Mythos 5.1 fica restrito a programas de acesso confiável para organizações verificadas de cibersegurança e ciências da vida

Então aqui a gente vai olhar só pro Fable, comparando as duas versões com o que a documentação e a página oficial do anúncio descrevem

Preço, benchmark, recursos novos e as breaking changes que podem pegar seu código de surpresa 🙂

Fable 5 x Fable 5.1: tabela de diferenças

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 120 aulas
  • 4 projetos
  • 9h 45min

Antes da conversa longa, o resumo lado a lado

Item Claude Fable 5 Claude Fable 5.1
Preço de entrada US$ 10 por milhão de tokens US$ 10 por milhão de tokens
Preço de saída US$ 50 por milhão de tokens US$ 50 por milhão de tokens
Leitura de cache US$ 1,00 por milhão de tokens US$ 0,25 por milhão de tokens
Terminal-Bench-Science 0.1 24,7% 52,6%
Identificador na Claude API linha só do 5.1 claude-fable-5-1
Janela de contexto linha só do 5.1 1 milhão de tokens
Limite de saída linha só do 5.1 até 128 mil tokens
Adaptive thinking linha só do 5.1 ligado por padrão, esforço alto

As linhas marcadas como "só do 5.1" são dados publicados pra esta versão

Preço igual, conta menor: como a leitura de cache mais barata muda o custo

Essa é a única mudança de preço da atualização, e ela é bem cirúrgica

Entrada continua em US$ 10 por milhão de tokens

Saída continua em US$ 50 por milhão de tokens

O que caiu foi a leitura de cache: de US$ 1,00 por milhão no Fable 5 pra US$ 0,25 por milhão no 5.1, ou seja, um quarto do custo anterior

Que leitura de cache? É o pedaço do prompt que o modelo já viu antes e não precisa processar de novo do zero. Se você conhece cache de aplicação web, a ideia é a mesma: o conteúdo repetido sai muito mais barato na segunda vez

Aí vem a pergunta óbvia: isso muda quanto na fatura de verdade?

A própria Anthropic estima cerca de 25% mais barato em cargas típicas, e até cerca de 45% em cargas altamente agênticas

A lógica por trás disso é simples: quanto mais você reusa contexto, maior a fatia da sua conta que vem de leitura de cache

Agente longo relê instrução, relê arquivo, relê histórico o tempo todo

Quem manda uma pergunta solta e vai embora quase não sente

Quem roda pipeline de horas sente MUITO

O que melhorou em desempenho segundo as avaliações

Os ganhos declarados na atualização são três: programação agêntica de longa duração, pesquisa em várias etapas e trabalho com documentos, planilhas e slides

O número que mais chama atenção é o Terminal-Bench-Science 0.1, que avalia pesquisa científica agêntica

O Fable 5.1 fez 52,6% contra 24,7% do Fable 5

Mais que o dobro, se liga nisso

As duas versões 5.1 foram avaliadas em engenharia de software, raciocínio matemático e científico, contexto longo, busca agêntica e orquestração multiagente, tarefas multimodais e de uso de computador, trabalho profissional do mundo real e domínios multilíngue, de saúde e ciências da vida, superando Fable 5 e Mythos 5 na maioria das avaliações

E os maiores ganhos ficaram concentrados em trabalho científico e de engenharia no terminal, uso de computador e trabalho agêntico e profissional de longo horizonte

Repara no padrão: é tudo tarefa comprida, com muitas etapas, onde o modelo precisa aguentar o tranco sem se perder no meio do caminho

Modelo que roda por muito tempo sem alguém olhando também levanta a discussão sobre limites e supervisão de agentes, que é um papo que anda junto com esses ganhos de horizonte longo

Recursos novos que chegaram com o Fable 5.1

Aqui entram os aditivos, ou seja, coisas que apareceram sem quebrar o que já existia

  • Esforço por mensagem (beta): permite mudar o nível de esforço no meio da conversa sem invalidar o cache de prompt
  • Mensagens de sistema com escopo de turno (beta)
  • Atualizações de progresso legíveis entre chamadas de ferramenta: o display: "updates", em beta, com o header beta thinking-display-updates-2026-08-18
  • Preço menor de leitura de cache
  • Proveniência de conteúdo

O esforço por mensagem é o que mais casa com o resto da atualização

Pensa: antes, mexer no nível de esforço no meio do papo tinha o efeito colateral de derrubar o cache

Agora dá pra subir e descer o esforço conforme a etapa da tarefa e continuar aproveitando o cache que ficou mais barato

Dois detalhes de comportamento padrão que vale saber antes de apontar seu código pra ele:

O Fable 5.1 vem com adaptive thinking habilitado por padrão em nível de esforço alto

E o texto gerado por Claude Fable 5.1 e Claude Mythos 5.1 carrega marca d’água estatística de texto da Anthropic em toda plataforma onde o modelo está disponível

As 3 breaking changes que podem quebrar seu código

Essa é a parte que eu leria duas vezes antes de trocar o identificador do modelo em produção

São três mudanças que quebram compatibilidade:

  1. Uso forçado de ferramenta (forced tool use) retorna erro
  2. Modelos anteriores não conseguem ler os blocos de thinking dele
  3. Editar turnos anteriores invalida os blocos de thinking

A primeira é a mais afiada, porque forced tool use é padrão comum em pipeline que precisa de saída garantida em formato de ferramenta

A segunda pega quem faz roteamento entre modelos, passando histórico de um pro outro

A terceira pega quem reescreve turno anterior pra corrigir contexto no meio da execução

Tome cuidado! O caminho é mapear onde seu código faz essas três coisas antes de migrar

Quando vale trocar do Fable 5 para o 5.1 (e quando tanto faz)

Os cenários em que a troca se paga sozinha:

  • Pipeline agêntico longo: é onde a estimativa de até cerca de 45% de economia aparece, e é justamente a área de maior ganho declarado
  • Carga com muito reuso de contexto: se boa parte dos seus tokens é releitura de prompt cacheado, o preço a um quarto muda a conta na hora
  • Pesquisa em várias etapas: o salto de 24,7% pra 52,6% no Terminal-Bench-Science 0.1 é o dado mais direto nesse sentido
  • Trabalho com documentos, planilhas e slides: entra na lista oficial de melhorias

E o contraponto, porque nem tudo é festa:

Se a sua carga usa pouco cache, a economia vira quase nada, já que entrada e saída seguem no mesmo preço

E se ela depende de forced tool use, você não tem só uma troca de string de modelo pela frente, você tem trabalho de migração

Nesse caso, decidir com calma é mais barato que decidir rápido

Onde usar: plataformas, identificador e tempo de vida do modelo

Na Claude API o identificador do modelo é claude-fable-5-1

E o Claude Fable 5.1 está disponível em Claude API, Amazon Bedrock, Claude Platform na AWS, Google Cloud e Microsoft Foundry

Se você já pensou na questão de rodar o mesmo modelo em provedores diferentes, a lógica continua valendo aqui, só muda o identificador que você aponta

Sobre tempo de vida: o modelo não está previsto para ser aposentado antes de 1 de setembro de 2027

Ou seja, dá pra construir em cima dele sem aquele frio na barriga de deprecação em três meses

Vale a atualização? Nosso veredito

É uma atualização de baixo atrito no bolso e de atrito médio no código

No bolso, porque entrada e saída ficaram idênticas e a única mudança de preço foi pra baixo, com a leitura de cache a um quarto do custo e a estimativa oficial de cerca de 25% em cargas típicas e até cerca de 45% nas altamente agênticas

No código, porque as três breaking changes são reais e batem justamente em padrões populares: forced tool use e manipulação de histórico com blocos de thinking

Se o seu projeto não usa nenhum dos dois, a troca fica perto de só mudar a string do modelo

Se usa, tem trabalho de migração no meio do caminho, e é ele que define se a conta menor compensa agora ou daqui a um mês

O salto no benchmark científico agêntico é o argumento mais forte a favor: 52,6% contra 24,7% não é ajuste fino, é outra faixa de resultado

Importante deixar claro: essa análise se apoia nos dados oficiais publicados sobre o modelo, sem teste próprio aqui do lado

Então trate os números como ponto de partida da sua avaliação, não como substituto dela

Conclusão: o próximo passo

A lógica do Fable 5.1 cabe em uma linha: preço de entrada e saída igual, leitura de cache muito mais barata e ganho declarado em trabalho agêntico longo, pesquisa multietapa e documentos, planilhas e slides

Quanto mais a sua carga parece com um agente rodando por horas em cima do mesmo contexto, mais essa combinação te favorece

O próximo passo prático não é trocar o modelo, é abrir seu código e procurar duas coisas: uso forçado de ferramenta e qualquer lugar onde você edita turnos anteriores ou repassa blocos de thinking entre modelos

Resolvido isso, aí sim é só apontar pra claude-fable-5-1 na plataforma que você já usa

até o próximo post! 😀

Perguntas frequentes

Claude Fable 5.1 é mais caro que o Fable 5?

Não no que é cobrado por token de entrada e saída. O Fable 5.1 mantém US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída, exatamente igual ao Fable 5. A única mudança de preço foi pra baixo, na leitura de cache, que caiu pra US$ 0,25 por milhão de tokens.

Qual é o identificador do Claude Fable 5.1 na API da Anthropic?

O identificador do modelo na Claude API é claude-fable-5-1. É esse o valor que entra no campo de modelo das suas chamadas pra apontar pro Fable 5.1.

Em quais plataformas dá pra usar o Claude Fable 5.1?

O modelo está disponível na Claude API, no Amazon Bedrock, na Claude Platform na AWS, no Google Cloud e no Microsoft Foundry. Ou seja, não fica preso a um único provedor de nuvem.

Qual o tamanho da janela de contexto do Fable 5.1?

A janela de contexto vai até 1 milhão de tokens, com limite de saída de até 128 mil tokens. Isso ajuda justamente nos casos de uso que a atualização reforça, como pesquisa em várias etapas e trabalho com documentos longos.

Quando o Claude Fable 5.1 vai ser aposentado?

Segundo a Anthropic, o modelo não está previsto pra ser aposentado antes de 1 de setembro de 2027. Dá uma boa margem pra planejar migração de projeto sem pressa.

Dá pra usar forced tool use com o Fable 5.1?

Não, essa é uma das breaking changes da versão. No Fable 5.1, o uso forçado de ferramenta (forced tool use) retorna erro, então pipeline que dependia disso pra garantir saída em formato de ferramenta precisa ser revisado antes da migração.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares