Claude 3.7 Sonnet: o que era o raciocínio estendido e onde ele está hoje?

linha do tempo do Claude 3.7 Sonnet até o raciocínio adaptativo atual
Resposta rápida

O Claude 3.7 Sonnet foi anunciado em 24 de fevereiro de 2025 como o primeiro modelo de raciocínio híbrido do mercado, com liga/desliga do raciocínio estendido e pensamento passo a passo visível. Esse modelo já foi retirado da plataforma da Anthropic (substituto recomendado: Claude Sonnet 4.6), então o tutorial antigo não bate mais com a sua tela. O comportamento continuou, só mudou de nome e de lugar: hoje ele vive como pensamento adaptativo mais nível de effort, no menu de modelo do Claude.ai, no /model do Claude Code e no thinking.type adaptive da API

Você abre um tutorial, ele manda ligar o raciocínio estendido do Claude 3.7 Sonnet, e o botão simplesmente não está lá

Fala aí, beleza? Essa é uma das confusões mais comuns de quem chegou agora no Claude: o modelo que popularizou o "pensar antes de responder" saiu de cena, mas o comportamento dele não sumiu

Ele mudou de nome, mudou de lugar e mudou de lógica

Bora entender o que era, o que aconteceu e onde procurar hoje?

O que o Claude 3.7 Sonnet introduziu com o raciocínio estendido:

O Claude 3.7 Sonnet foi anunciado pela Anthropic em 24 de fevereiro de 2025, no mesmo dia em que o Claude Code apareceu como research preview limitado

A Anthropic apresentou ele como o primeiro modelo de raciocínio híbrido disponível no mercado

E o que isso queria dizer? Que o mesmo modelo podia dar uma resposta quase instantânea OU fazer um raciocínio estendido, passo a passo, visível para quem estava do outro lado da tela

Domine o Claude Code do básico ao avançado
Pré-inscrição Formação Claude Code

Domine o Claude Code do básico ao avançado

Você vai aprender a criar sistemas completos com Claude Code, sem precisar ser programador. Inscreva-se para ter acesso a um desconto de lançamento e bônus especiais!

O controle disso era bem literal: um liga/desliga do modo de raciocínio estendido, na mão do usuário, pra direcionar o modelo a pensar mais fundo nas perguntas mais difíceis

Pela API, dava pra ir além do liga/desliga e definir um orçamento de pensamento: pensar por no máximo N tokens, pra qualquer N até o limite de saída de 128 mil tokens

E tinha um detalhe que ajudou muito na adoção: o preço era o mesmo nos dois modos (padrão e estendido) e igual ao dos antecessores, US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída

Os tokens de pensamento contavam como tokens de saída, então pensar mais custava mais, mas não existia uma "tarifa de raciocínio" separada

Por que o tutorial antigo não funciona mais:

Aqui está a parte que quebra o passo a passo de 2025

O Claude Sonnet 3.7 (identificador claude-3-7-sonnet-20250219) está aposentado na plataforma da Anthropic, e as requisições a ele retornam erro

A linha do tempo foi essa: a Anthropic avisou os desenvolvedores sobre a aposentadoria em 28 de outubro de 2025, e o modelo foi retirado em 19 de fevereiro de 2026

A própria página oficial de descontinuações indica o Claude Sonnet 4.6 como substituto recomendado pra quem usava o Sonnet 3.7

E o Sonnet 4.6 foi lançado em 17 de fevereiro de 2026, dois dias antes da retirada do 3.7

Ou seja: se o seu script chama aquele identificador, ele não vai "responder pior", ele vai falhar

E se o tutorial manda procurar o liga/desliga do raciocínio estendido, você não vai achar o mesmo controle, porque hoje o controle é outro 🙂

Raciocínio estendido no 3.7 x raciocínio adaptativo hoje:

Colocando lado a lado fica mais fácil de enxergar o que mudou de verdade:

O que Claude 3.7 Sonnet Como está hoje
Controle do raciocínio toggle de liga/desliga do modo estendido, na mão do usuário pensamento adaptativo mais nível de effort
Controle da quantidade budget_tokens: pensar por até N tokens, até o limite de saída de 128K max_tokens como limite duro do total de saída, e effort como orientação suave de quanto pensar
Visibilidade do pensamento passo a passo visível pro usuário resumo por padrão nos modelos Claude 4 na Messages API, e pensamento colapsado por padrão no Claude Code
Status do modelo ativo no lançamento, em 24/02/2025 retirado em 19/02/2026, substituto recomendado Claude Sonnet 4.6

Repara que a mudança não é só de botão

Antes você mandava o modelo pensar e dizia até quanto

Agora o pensamento é adaptativo (o modelo decide) e o que você mexe é um nível de esforço

Onde está o raciocínio estendido no Claude.ai:

No Claude.ai, tudo mora no menu de modelo que fica ao lado do botão de enviar

Esse menu controla três coisas de uma vez:

  • qual modelo responde
  • o nível de effort
  • se o pensamento está ligado (o toggle se chama Thinking)

Pensamento e effort são configurações separadas e podem ser combinadas de qualquer forma

O effort controla quanto pensamento o Claude aplica na resposta, e o toggle de pensamento controla se ele raciocina numa seção expansível antes de responder

E dá pra trocar modelo, nível de effort ou a configuração de pensamento em qualquer ponto da conversa

A mudança vale a partir da próxima resposta do Claude, então não precisa abrir chat novo pra testar

Esse é justamente o detalhe que o tutorial antigo erra: gente que ainda repete a regra velha de que mexer no pensamento reiniciava o papo

Onde está o raciocínio estendido no Claude Code:

No Claude Code o nome é o mesmo, effort, e ele controla o raciocínio adaptativo passo a passo: o modelo decide se e quanto pensar a cada etapa, conforme a complexidade da tarefa

Pra achar o controle:

  1. rode /model na sessão
  2. com um modelo compatível selecionado, o slider de effort aparece ali dentro
  3. confira o nível ativo no cabeçalho da sessão, que mostra o effort ao lado do nome do modelo

O erro comum aqui: escolher um nível e achar que ele valeu, sem olhar o cabeçalho

Os níveis disponíveis dependem do modelo, e se você definir um nível que o modelo ativo não suporta, ele cai pro maior nível suportado igual ou abaixo do escolhido

O xhigh, por exemplo, vira high em modelos sem suporte

O padrão é high em todos os modelos que suportam effort, com uma exceção: o Opus 4.7, que usa xhigh por padrão

Como cada modelo tem seu comportamento e seu bolso, vale cruzar isso com a escolha de qual modelo usar em cada tarefa antes de subir o nível no chute

E o pensamento? Ele existe, só está recolhido

O Claude Code colapsa a saída de pensamento por padrão, e o atalho Ctrl+O alterna o modo verbose, mostrando o raciocínio em texto cinza itálico

Quem vinha do 3.7 e sentia falta de ver o modelo pensando, tá ali, a um atalho de distância 😀

Onde está o raciocínio estendido na API:

Essa é a parte que mais dá dor de cabeça em código antigo

A configuração thinking.type com valor enabled mais budget_tokens está depreciada e será removida em um lançamento futuro

A recomendação atual é usar thinking.type com valor adaptive, junto do parâmetro effort

{
  "thinking": { "type": "enabled", "budget_tokens": 10000 }
}

Vira isso:

{
  "thinking": { "type": "adaptive" }
}

Tome cuidado com uma tentação aqui: o budget_tokens não tem substituto direto

O pensamento passa a ser adaptativo, e o effort é um controle separado, de nível de saída, não um orçamento de pensamento

Quem quiser um teto continua com o max_tokens, que funciona como limite duro do total de saída (pensamento mais texto de resposta), enquanto o effort dá uma orientação suave sobre quanto pensamento o Claude aloca

As configurações antigas com budget_tokens ainda funcionam, mas não são mais recomendadas

Outro ponto que muda a expectativa de quem vem do 3.7: nos modelos Claude 4, a Messages API devolve um resumo do pensamento por padrão (campo display não definido ou em summarized)

E a cobrança é feita sobre os tokens completos de pensamento gerados, não sobre os tokens do resumo

Mais uma curiosidade: esse resumo é produzido por um modelo diferente daquele que você chamou na requisição, e o modelo que pensa não vê a versão resumida

Pra quem trabalha com ferramentas, os modelos Claude 4 suportam interleaved thinking (pensar entre chamadas de ferramenta), habilitado pelo header beta interleaved-thinking-2025-05-14

Qual nível de effort usar em cada situação:

A central de ajuda descreve cinco níveis, e cada um tem um uso indicado:

  • low e medium: tarefas rotineiras, e quando você quer esticar o uso
  • high: o melhor equilíbrio entre qualidade e velocidade
  • xhigh: tarefas longas de código e agentes
  • max: a opção mais completa, pro raciocínio mais profundo

Na prática, esse é o "botãozinho" que sobrou do 3.7, só que com régua

Antes era pensa ou não pensa

Agora é o quanto pensa, e a resposta muda conforme a tarefa que tá na mesa

O que muda na prática quando você mexe no nível de raciocínio:

Quando fui percorrer o material de lançamento do Sonnet 5, teve um comportamento que me chamou MUITO a atenção

Conforme eu aumento o nível de raciocínio do modelo, a entrega continua melhorando

Parece óbvio, mas não é: pela minha observação, esse ganho contínuo ao subir o raciocínio não se repete em todos os outros modelos da Anthropic

E é exatamente por isso que o effort deixou de ser um detalhe escondido e virou um controle de primeira linha, no lugar do velho liga/desliga do 3.7

No vídeo eu comparo as versões do Sonnet lado a lado pelos benchmarks do artigo de lançamento antes de dar minha opinião sobre o upgrade

A conclusão a que cheguei: melhorou em todos os quesitos frente ao Sonnet anterior e chegou perto do modelo topo de linha por um custo menor, com o diferencial de continuar entregando mais conforme se aumenta o raciocínio

Se você quer sentir isso no fluxo real, do primeiro projeto até o deploy, dá pra observar o efeito no fluxo do projeto até o deploy, subindo e descendo o nível na mesma tarefa

Conclusão:

O Claude 3.7 Sonnet marcou o começo do pensamento controlável: raciocínio híbrido, passo a passo visível e um liga/desliga na mão do usuário

Esse modelo já foi retirado, e chamadas ao identificador antigo retornam erro, com o Sonnet 4.6 como substituto recomendado

Mas o comportamento ficou, só mudou de endereço: hoje ele vive no toggle Thinking e no nível de effort

Próximo passo, bem objetivo:

  1. abra o menu de modelo no Claude.ai e veja em que nível de effort você está, com o Thinking ligado ou não
  2. rode /model no Claude Code e confira o slider e o nível exibido no cabeçalho da sessão
  3. troque as chamadas antigas de budget_tokens por thinking.type adaptive com effort, antes que a configuração depreciada saia de vez

Aí é só ir subindo o nível na tarefa que realmente exige e ver o que acontece 🙂

até o próximo post!

Perguntas frequentes

O Claude 3.7 Sonnet ainda está disponível na API da Anthropic?

Não. O modelo está aposentado na plataforma da Anthropic e qualquer requisição para ele retorna erro. O aviso de aposentadoria saiu em 28 de outubro de 2025 e a retirada aconteceu em 19 de fevereiro de 2026.

O que acontece se eu chamar claude-3-7-sonnet-20250219 hoje?

A chamada falha, porque esse identificador foi retirado da plataforma. Não é uma resposta pior nem degradada, é erro direto na requisição.

Qual modelo substitui o Claude 3.7 Sonnet?

A página oficial de descontinuações indica o Claude Sonnet 4.6 como substituto recomendado. Ele foi lançado em 17 de fevereiro de 2026, dois dias antes da retirada do 3.7 Sonnet.

O parâmetro budget_tokens do raciocínio estendido ainda funciona?

Configurações antigas com budget_tokens ainda funcionam, mas essa opção está depreciada e será removida em um lançamento futuro. A recomendação atual é usar thinking.type adaptive com o parâmetro effort, já que o budget_tokens não tem um substituto direto de mesma lógica.

Effort e o toggle Thinking são a mesma configuração no Claude.ai?

Não, são configurações separadas e podem ser combinadas de qualquer jeito. O effort controla quanto pensamento o Claude aplica na resposta, enquanto o toggle Thinking define se ele raciocina numa seção expansível antes de responder.

Por que eu não vejo o Claude pensando no Claude Code?

Porque o Claude Code recolhe a saída de pensamento por padrão. Basta usar o atalho Ctrl+O para ligar o modo verbose e ver o raciocínio em texto cinza itálico.




Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares