Claude 3.7 Sonnet: o que era o raciocínio estendido e onde ele está hoje?

O Claude 3.7 Sonnet foi anunciado em 24 de fevereiro de 2025 como o primeiro modelo de raciocínio híbrido do mercado, com liga/desliga do raciocínio estendido e pensamento passo a passo visível. Esse modelo já foi retirado da plataforma da Anthropic (substituto recomendado: Claude Sonnet 4.6), então o tutorial antigo não bate mais com a sua tela. O comportamento continuou, só mudou de nome e de lugar: hoje ele vive como pensamento adaptativo mais nível de effort, no menu de modelo do Claude.ai, no /model do Claude Code e no thinking.type adaptive da API
Você abre um tutorial, ele manda ligar o raciocínio estendido do Claude 3.7 Sonnet, e o botão simplesmente não está lá
Fala aí, beleza? Essa é uma das confusões mais comuns de quem chegou agora no Claude: o modelo que popularizou o "pensar antes de responder" saiu de cena, mas o comportamento dele não sumiu
Ele mudou de nome, mudou de lugar e mudou de lógica
Bora entender o que era, o que aconteceu e onde procurar hoje?
O que o Claude 3.7 Sonnet introduziu com o raciocínio estendido:
O Claude 3.7 Sonnet foi anunciado pela Anthropic em 24 de fevereiro de 2025, no mesmo dia em que o Claude Code apareceu como research preview limitado
A Anthropic apresentou ele como o primeiro modelo de raciocínio híbrido disponível no mercado
E o que isso queria dizer? Que o mesmo modelo podia dar uma resposta quase instantânea OU fazer um raciocínio estendido, passo a passo, visível para quem estava do outro lado da tela
Domine o Claude Code do básico ao avançado
Você vai aprender a criar sistemas completos com Claude Code, sem precisar ser programador. Inscreva-se para ter acesso a um desconto de lançamento e bônus especiais!
O controle disso era bem literal: um liga/desliga do modo de raciocínio estendido, na mão do usuário, pra direcionar o modelo a pensar mais fundo nas perguntas mais difíceis
Pela API, dava pra ir além do liga/desliga e definir um orçamento de pensamento: pensar por no máximo N tokens, pra qualquer N até o limite de saída de 128 mil tokens
E tinha um detalhe que ajudou muito na adoção: o preço era o mesmo nos dois modos (padrão e estendido) e igual ao dos antecessores, US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída
Os tokens de pensamento contavam como tokens de saída, então pensar mais custava mais, mas não existia uma "tarifa de raciocínio" separada
Por que o tutorial antigo não funciona mais:
Aqui está a parte que quebra o passo a passo de 2025
O Claude Sonnet 3.7 (identificador claude-3-7-sonnet-20250219) está aposentado na plataforma da Anthropic, e as requisições a ele retornam erro
A linha do tempo foi essa: a Anthropic avisou os desenvolvedores sobre a aposentadoria em 28 de outubro de 2025, e o modelo foi retirado em 19 de fevereiro de 2026
A própria página oficial de descontinuações indica o Claude Sonnet 4.6 como substituto recomendado pra quem usava o Sonnet 3.7
E o Sonnet 4.6 foi lançado em 17 de fevereiro de 2026, dois dias antes da retirada do 3.7
Ou seja: se o seu script chama aquele identificador, ele não vai "responder pior", ele vai falhar
E se o tutorial manda procurar o liga/desliga do raciocínio estendido, você não vai achar o mesmo controle, porque hoje o controle é outro 🙂
Raciocínio estendido no 3.7 x raciocínio adaptativo hoje:
Colocando lado a lado fica mais fácil de enxergar o que mudou de verdade:
| O que | Claude 3.7 Sonnet | Como está hoje |
|---|---|---|
| Controle do raciocínio | toggle de liga/desliga do modo estendido, na mão do usuário | pensamento adaptativo mais nível de effort |
| Controle da quantidade | budget_tokens: pensar por até N tokens, até o limite de saída de 128K |
max_tokens como limite duro do total de saída, e effort como orientação suave de quanto pensar |
| Visibilidade do pensamento | passo a passo visível pro usuário | resumo por padrão nos modelos Claude 4 na Messages API, e pensamento colapsado por padrão no Claude Code |
| Status do modelo | ativo no lançamento, em 24/02/2025 | retirado em 19/02/2026, substituto recomendado Claude Sonnet 4.6 |
Repara que a mudança não é só de botão
Antes você mandava o modelo pensar e dizia até quanto
Agora o pensamento é adaptativo (o modelo decide) e o que você mexe é um nível de esforço
Onde está o raciocínio estendido no Claude.ai:
No Claude.ai, tudo mora no menu de modelo que fica ao lado do botão de enviar
Esse menu controla três coisas de uma vez:
- qual modelo responde
- o nível de effort
- se o pensamento está ligado (o toggle se chama Thinking)
Pensamento e effort são configurações separadas e podem ser combinadas de qualquer forma
O effort controla quanto pensamento o Claude aplica na resposta, e o toggle de pensamento controla se ele raciocina numa seção expansível antes de responder
E dá pra trocar modelo, nível de effort ou a configuração de pensamento em qualquer ponto da conversa
A mudança vale a partir da próxima resposta do Claude, então não precisa abrir chat novo pra testar
Esse é justamente o detalhe que o tutorial antigo erra: gente que ainda repete a regra velha de que mexer no pensamento reiniciava o papo
Onde está o raciocínio estendido no Claude Code:
No Claude Code o nome é o mesmo, effort, e ele controla o raciocínio adaptativo passo a passo: o modelo decide se e quanto pensar a cada etapa, conforme a complexidade da tarefa
Pra achar o controle:
- rode
/modelna sessão - com um modelo compatível selecionado, o slider de effort aparece ali dentro
- confira o nível ativo no cabeçalho da sessão, que mostra o effort ao lado do nome do modelo
O erro comum aqui: escolher um nível e achar que ele valeu, sem olhar o cabeçalho
Os níveis disponíveis dependem do modelo, e se você definir um nível que o modelo ativo não suporta, ele cai pro maior nível suportado igual ou abaixo do escolhido
O xhigh, por exemplo, vira high em modelos sem suporte
O padrão é high em todos os modelos que suportam effort, com uma exceção: o Opus 4.7, que usa xhigh por padrão
Como cada modelo tem seu comportamento e seu bolso, vale cruzar isso com a escolha de qual modelo usar em cada tarefa antes de subir o nível no chute
E o pensamento? Ele existe, só está recolhido
O Claude Code colapsa a saída de pensamento por padrão, e o atalho Ctrl+O alterna o modo verbose, mostrando o raciocínio em texto cinza itálico
Quem vinha do 3.7 e sentia falta de ver o modelo pensando, tá ali, a um atalho de distância 😀
Onde está o raciocínio estendido na API:
Essa é a parte que mais dá dor de cabeça em código antigo
A configuração thinking.type com valor enabled mais budget_tokens está depreciada e será removida em um lançamento futuro
A recomendação atual é usar thinking.type com valor adaptive, junto do parâmetro effort
{
"thinking": { "type": "enabled", "budget_tokens": 10000 }
}
Vira isso:
{
"thinking": { "type": "adaptive" }
}
Tome cuidado com uma tentação aqui: o budget_tokens não tem substituto direto
O pensamento passa a ser adaptativo, e o effort é um controle separado, de nível de saída, não um orçamento de pensamento
Quem quiser um teto continua com o max_tokens, que funciona como limite duro do total de saída (pensamento mais texto de resposta), enquanto o effort dá uma orientação suave sobre quanto pensamento o Claude aloca
As configurações antigas com budget_tokens ainda funcionam, mas não são mais recomendadas
Outro ponto que muda a expectativa de quem vem do 3.7: nos modelos Claude 4, a Messages API devolve um resumo do pensamento por padrão (campo display não definido ou em summarized)
E a cobrança é feita sobre os tokens completos de pensamento gerados, não sobre os tokens do resumo
Mais uma curiosidade: esse resumo é produzido por um modelo diferente daquele que você chamou na requisição, e o modelo que pensa não vê a versão resumida
Pra quem trabalha com ferramentas, os modelos Claude 4 suportam interleaved thinking (pensar entre chamadas de ferramenta), habilitado pelo header beta interleaved-thinking-2025-05-14
Qual nível de effort usar em cada situação:
A central de ajuda descreve cinco níveis, e cada um tem um uso indicado:
- low e medium: tarefas rotineiras, e quando você quer esticar o uso
- high: o melhor equilíbrio entre qualidade e velocidade
- xhigh: tarefas longas de código e agentes
- max: a opção mais completa, pro raciocínio mais profundo
Na prática, esse é o "botãozinho" que sobrou do 3.7, só que com régua
Antes era pensa ou não pensa
Agora é o quanto pensa, e a resposta muda conforme a tarefa que tá na mesa
O que muda na prática quando você mexe no nível de raciocínio:
Quando fui percorrer o material de lançamento do Sonnet 5, teve um comportamento que me chamou MUITO a atenção
Conforme eu aumento o nível de raciocínio do modelo, a entrega continua melhorando
Parece óbvio, mas não é: pela minha observação, esse ganho contínuo ao subir o raciocínio não se repete em todos os outros modelos da Anthropic
E é exatamente por isso que o effort deixou de ser um detalhe escondido e virou um controle de primeira linha, no lugar do velho liga/desliga do 3.7
No vídeo eu comparo as versões do Sonnet lado a lado pelos benchmarks do artigo de lançamento antes de dar minha opinião sobre o upgrade
A conclusão a que cheguei: melhorou em todos os quesitos frente ao Sonnet anterior e chegou perto do modelo topo de linha por um custo menor, com o diferencial de continuar entregando mais conforme se aumenta o raciocínio
Se você quer sentir isso no fluxo real, do primeiro projeto até o deploy, dá pra observar o efeito no fluxo do projeto até o deploy, subindo e descendo o nível na mesma tarefa
Conclusão:
O Claude 3.7 Sonnet marcou o começo do pensamento controlável: raciocínio híbrido, passo a passo visível e um liga/desliga na mão do usuário
Esse modelo já foi retirado, e chamadas ao identificador antigo retornam erro, com o Sonnet 4.6 como substituto recomendado
Mas o comportamento ficou, só mudou de endereço: hoje ele vive no toggle Thinking e no nível de effort
Próximo passo, bem objetivo:
- abra o menu de modelo no Claude.ai e veja em que nível de effort você está, com o Thinking ligado ou não
- rode
/modelno Claude Code e confira o slider e o nível exibido no cabeçalho da sessão - troque as chamadas antigas de
budget_tokensporthinking.typeadaptive com effort, antes que a configuração depreciada saia de vez
Aí é só ir subindo o nível na tarefa que realmente exige e ver o que acontece 🙂
até o próximo post!
Perguntas frequentes
O Claude 3.7 Sonnet ainda está disponível na API da Anthropic?
Não. O modelo está aposentado na plataforma da Anthropic e qualquer requisição para ele retorna erro. O aviso de aposentadoria saiu em 28 de outubro de 2025 e a retirada aconteceu em 19 de fevereiro de 2026.
O que acontece se eu chamar claude-3-7-sonnet-20250219 hoje?
A chamada falha, porque esse identificador foi retirado da plataforma. Não é uma resposta pior nem degradada, é erro direto na requisição.
Qual modelo substitui o Claude 3.7 Sonnet?
A página oficial de descontinuações indica o Claude Sonnet 4.6 como substituto recomendado. Ele foi lançado em 17 de fevereiro de 2026, dois dias antes da retirada do 3.7 Sonnet.
O parâmetro budget_tokens do raciocínio estendido ainda funciona?
Configurações antigas com budget_tokens ainda funcionam, mas essa opção está depreciada e será removida em um lançamento futuro. A recomendação atual é usar thinking.type adaptive com o parâmetro effort, já que o budget_tokens não tem um substituto direto de mesma lógica.
Effort e o toggle Thinking são a mesma configuração no Claude.ai?
Não, são configurações separadas e podem ser combinadas de qualquer jeito. O effort controla quanto pensamento o Claude aplica na resposta, enquanto o toggle Thinking define se ele raciocina numa seção expansível antes de responder.
Por que eu não vejo o Claude pensando no Claude Code?
Porque o Claude Code recolhe a saída de pensamento por padrão. Basta usar o atalho Ctrl+O para ligar o modo verbose e ver o raciocínio em texto cinza itálico.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
As diferenças de var, let e const
Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]
Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação
Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação A popularidade da automação de processos com o n8n está em alta, principalmente […]
