Claude Sonnet 5: o que é e em que tipo de trabalho ele encaixa melhor

O Claude Sonnet 5 é a faixa intermediária da família Claude, lançada pela Anthropic em 30 de junho de 2026, e é o modelo padrão dos planos Free e Pro do Claude.ai. A Anthropic o posiciona como o Sonnet mais agêntico da família: planeja, usa ferramentas como navegador e terminal e executa com autonomia. Tem 1 milhão de tokens de contexto, até 128 mil de saída e custa US$ 2 por milhão de tokens de entrada e US$ 10 de saída, valor que ficou permanente. O parâmetro effort regula quanto ele pensa em cada tarefa.
Fala aí, beleza? O modelo mais usado da família Claude é justamente aquele que quase ninguém escolhe na mão
Se você entra no Claude.ai no plano Free ou no Pro e simplesmente manda sua pergunta, quem responde é o Claude Sonnet 5
Ele é a faixa intermediária da família: nem o topo caro, nem o modelo mínimo de tarefa simples
E é aí que mora a graça, porque "intermediário" nesse caso não quer dizer fraquinho, quer dizer o que roda a maior parte do trabalho de verdade
Neste post eu monto o perfil dele: o que ele é, onde ele está disponível, como funciona o controle de esforço e, principalmente, o MAPA de tarefas em que ele é a escolha padrão 🙂
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 120 aulas
- 4 projetos
- 9h 45min
O que é o Claude Sonnet 5 e onde ele está disponível
O Claude Sonnet 5 foi lançado pela Anthropic em 30 de junho de 2026
O posicionamento oficial no anúncio da Anthropic é direto: é o Sonnet mais agêntico da família
Ou seja, ele foi feito pra planejar, usar ferramentas (navegador, terminal) e executar tarefas com autonomia, com foco em código, agentes e trabalho profissional do dia a dia em escala
Agêntico aqui não é buzzword, é o tipo de uso em que tu não fica no chat de ida e volta: tu descreve o objetivo e o modelo vai lá, roda, lê o resultado e continua
Onde ele roda:
- Claude.ai: é o modelo padrão dos planos Free e Pro, e está disponível também em Max, Team e Enterprise
- Claude API: o identificador do modelo é
claude-sonnet-5 - Amazon Bedrock, Google Cloud e Microsoft Foundry: também disponível, todos com 1M de contexto
A ficha técnica:
- Janela de contexto de 1 milhão de tokens por padrão, e esse é o máximo: não existe variante de contexto reduzido pra escolher
- Saída máxima de 128 mil tokens
- Na Message Batches API a saída vai até 300 mil tokens, usando o cabeçalho beta
output-300k-2026-03-24 - Suporta adaptive thinking, além das mesmas ferramentas e recursos de plataforma do Sonnet 4.6 (o que muda são alguns parâmetros de chamada, e eu detalho isso lá embaixo na parte de migração)
E o preço, que é a parte que costuma travar decisão: US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída
Esse valor era introdutório e ia subir pra US$ 3 / US$ 15 em 1º de setembro de 2026
Porém em 10 de agosto de 2026 a Anthropic anunciou que o aumento foi cancelado e o preço permanece inalterado
Bom pra quem planeja custo de sistema em produção, que é onde aumento de tabela dói de verdade
E ele é bom? O que diz o índice:
Na página viva do Artificial Analysis, o Claude Sonnet 5 aparece em 5º lugar no Intelligence Index
Que índice? É um agregado, não uma prova única
A versão v4.1.1 do índice é composta por 9 avaliações: GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity’s Last Exam, GPQA Diamond, CritPt, AA-Omniscience e AA-LCR
Então é uma média de capacidades diferentes (conhecimento, raciocínio, código, uso de ferramenta, contexto longo), e não o retrato de uma tarefa específica sua
Se você quiser cravar a decisão dentro da própria família, tem um post aqui do blog só sobre escolher entre Opus 5 e Sonnet 5 tarefa por tarefa
Os níveis de effort do Sonnet 5: qual escolher em cada tarefa
Essa é a parte que muda mais o resultado no dia a dia e que muita gente ignora
O Sonnet 5 usa o parâmetro effort pra regular inteligência versus gasto de tokens
São cinco níveis: low, medium, high, xhigh e max
Analogia de aproximação: pensa no effort como o tanto de tempo que você dá pra alguém pensar antes de responder
Cinco minutos resolve um e-mail, cinco minutos não resolve uma refatoração
| Nível de effort | Comportamento e tipo de trabalho |
|---|---|
low |
O modelo limita o trabalho ao que foi pedido, em vez de ir além. Faixa mais econômica em tokens |
medium |
Mesmo comportamento estrito de escopo do low, com mais folga de raciocínio |
high |
É o padrão da API. Faixa de referência pra quem não passa o parâmetro |
xhigh |
Recomendação oficial para as tarefas mais difíceis de código e de agente |
max |
Topo da escala de effort disponível no modelo |
O detalhe importante: o valor que você envia sobrescreve o padrão
Se não mandar nada na API, tu roda em high e nem percebe
O comportamento estrito (e o erro comum aqui):
O Sonnet 5 respeita os níveis de effort de forma estrita, principalmente na ponta de baixo
Em low e medium ele limita o trabalho ao que foi pedido, em vez de ir além por conta própria
Aí acontece o clássico: a resposta sai rasa, e a pessoa começa a escrever prompt gigante com "pense profundamente", "analise com muito cuidado", "seja extremamente detalhado"
A orientação oficial na documentação do effort é outra: quando o raciocínio sair raso, suba o effort para high ou xhigh, em vez de tentar contornar via prompt
Ou seja, o botão existe… use o botão! 😀
Em que tipo de trabalho o Sonnet 5 encaixa melhor
Agora o núcleo do post
Cada encaixe abaixo vem de uma característica concreta do modelo, não de vibe
1. Agentes que rodam sozinhos
O posicionamento oficial é justamente esse: planejar, usar navegador e terminal, executar com autonomia
É o caso de uso em que você define o objetivo e sai da frente, tipo pipeline de manutenção, triagem de tarefa repetitiva, rotina que abre ferramenta e devolve resultado
Nível sugerido: xhigh, que é a recomendação oficial pras tarefas mais difíceis de agente
2. Código do dia a dia em volume
Aqui entra o trabalho que não é glamouroso e é a maior parte da vida: ajuste, correção, teste, refator pequeno, script de apoio
O que sustenta o encaixe é a combinação de preço estável (US$ 2 / US$ 10 por milhão de tokens) com foco declarado em código
Nível sugerido: high, que já é o padrão, subindo pra xhigh quando a tarefa endurecer
3. Leitura de base grande e documento longo
Contexto de 1 milhão de tokens por padrão, sem variante reduzida pra escolher
Isso é o que permite jogar muita coisa junto: vários arquivos de um projeto, documentação inteira, histórico longo de conversa
O valor real não é "caber", é o modelo cruzar coisa que está em pontas distantes do material
Nível sugerido: high pra leitura e resumo, xhigh quando a pergunta exigir amarrar pedaços espalhados
4. Geração de saída extensa
Saída máxima de 128 mil tokens no uso normal
É o encaixe pra quem gera artefato grande de uma vez: arquivo de código longo, migração de conteúdo, documento estruturado, tradução de material inteiro
5. Processamento em lote
Na Message Batches API a saída estendida vai até 300 mil tokens com o cabeçalho beta output-300k-2026-03-24
Então se o seu trabalho é assíncrono por natureza (processar uma fila de itens, classificar um monte de registro, gerar em massa), esse é o caminho
Esse tipo de tarefa de volume em fluxo de empresa é onde os modelos de faixa intermediária brilham, e vale comparar com o Gemini 3.7 Flash em fluxos corporativos antes de fechar arquitetura
6. Uso cotidiano no Claude.ai
Se você está no Free ou no Pro, o Sonnet 5 já é o padrão, então esse encaixe é automático
A questão nem é escolher, é saber que o modelo que te responde ali é o mesmo perfil agêntico que roda os fluxos de código
O que muda é o contexto e as ferramentas que você dá pra ele
Vindo do Sonnet 4.6: o tokenizador novo e o que quebra no código
Se você já tem código rodando no Sonnet 4.6, se liga nisso antes de trocar o nome do modelo e sair correndo
Ponto 1: o tokenizador é novo
O Sonnet 5 usa um tokenizador novo, que gera cerca de 30% mais tokens para o mesmo texto em comparação com o Sonnet 4.6
O aumento exato depende do conteúdo e do tipo de carga
A consequência prática: como o mesmo texto vira mais tokens, o custo de uma requisição equivalente NÃO cai na mesma proporção da redução do preço por token
A orientação oficial no guia de migração é medir seus prompts sob o novo tokenizador antes de migrar
Tome cuidado aqui, porque é exatamente o tipo de conta que parece boa na planilha e surpreende na fatura
Ponto 2: duas coisas passam a dar erro 400
São duas quebras de compatibilidade:
- Extended thinking manual: o formato
thinking: {type: "enabled", budget_tokens: N}deixou de ser aceito - Parâmetros de amostragem:
temperature,top_petop_kcom valores fora do padrão também deixaram de ser aceitos
Nos dois casos a chamada retorna erro 400
O caminho oficial é usar adaptive thinking com o parâmetro effort, que é o controle que substitui o orçamento manual de raciocínio
Ou seja, aquele ajuste fino que você fazia na mão virou uma escala de cinco níveis
Fora esses dois pontos, o resto continua igual: o Sonnet 5 suporta o mesmo conjunto de ferramentas e recursos de plataforma do Sonnet 4.6, então não é migração de reescrever tudo, é migração de arrumar esses dois parâmetros e remedir custo
Vale usar o Sonnet 5 como padrão?
Recapitulando o perfil em três linhas: é o modelo de faixa intermediária da família Claude, com posicionamento agêntico (planeja, usa navegador e terminal, executa sozinho)
Tem contexto de 1 milhão de tokens por padrão, saída de até 128 mil tokens e preço que ficou permanente em US$ 2 / US$ 10 por milhão
Isso faz dele uma escolha padrão bem defensável pra maior parte do trabalho de código e automação, deixando o topo da família pro que realmente pede
Próximo passo concreto: se você é usuário de chat, é só abrir o Claude.ai, onde ele já é o padrão no Free e no Pro
Se você é quem escreve o código, chame claude-sonnet-5 na API e ajuste o effort conforme a dificuldade da tarefa, sem tentar compensar com prompt inflado
E se o sistema já está em produção no Sonnet 4.6, meça seus prompts sob o novo tokenizador ANTES de trocar
Bora testar? 😀
até o próximo post!
Perguntas frequentes
O Claude Sonnet 5 é grátis no Claude.ai?
Sim, ele é o modelo padrão do plano Free e também do Pro. Ou seja, quem usa o Claude.ai sem pagar nada já está conversando com o Sonnet 5 por padrão.
Quanto custa o Claude Sonnet 5 na API?
US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. Esse preço era introdutório e subiria em 1º de setembro de 2026, mas a Anthropic cancelou o aumento em 10 de agosto de 2026, então o valor ficou permanente.
Qual é o identificador do Claude Sonnet 5 na API?
O model ID é claude-sonnet-5. É esse o valor que você passa nas chamadas via Claude API, Amazon Bedrock, Google Cloud ou Microsoft Foundry.
Código feito para o Sonnet 4.6 funciona direto no Sonnet 5?
Não totalmente. As ferramentas e os recursos de plataforma continuam os mesmos, mas dois parâmetros de chamada mudaram: o extended thinking manual (thinking com budget_tokens) e os parâmetros temperature, top_p e top_k fora do padrão deixaram de ser aceitos e retornam erro 400. O caminho agora é usar adaptive thinking com o parâmetro effort.
Qual o nível de effort padrão do Claude Sonnet 5 na API?
O padrão é high quando você não passa o parâmetro effort. Para tarefas mais difíceis de código e de agente, a recomendação oficial é subir explicitamente para xhigh.
O Claude Sonnet 5 gasta mais tokens que o Sonnet 4.6 para o mesmo texto?
Sim, o tokenizador novo gera cerca de 30% mais tokens para o mesmo conteúdo. Por isso o custo de uma requisição equivalente não cai na mesma proporção da redução do preço por token, e vale medir os prompts antes de migrar.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares

Como instalar Claude Code: guia completo para iniciantes
Aprenda como instalar Claude Code, autenticar sua conta e usar o /init para configurar seu projeto. Veja requisitos e métodos nativo, Homebrew e WinGet. Pra […]

Claude Code Preço: quanto custa, planos Pro vs Max e API
Conheça detalhadamente o Claude Code preço, incluindo os planos Pro e Max, opções gratuitas, e os valores da API para diferentes níveis de uso e […]

Como gerenciar contexto no Claude Code: tokens, /compact e /clear
Descubra como gerenciar contexto no Claude Code utilizando tokens de modo eficiente, conheça os comandos /compact e /clear e mantenha a alta qualidade das suas […]
