Quanto contexto o Claude Code aguenta antes de perder o fio da tarefa?

tela do comando /context mostrando o limite de contexto do Claude Code antes de perder o fio da tarefa
Resposta rápida

O contexto do Claude Code não é só o que você digitou: a janela guarda as instruções, os arquivos lidos, as respostas do próprio agente e conteúdo que nunca aparece no terminal. CLAUDE.md, memória automática, nomes de ferramentas MCP e descrições de skills já entram no início da sessão. Pra saber quanto sobrou, rode /context e leia a quebra por categoria. Pra aliviar sem recomeçar do zero: /compact com foco, /autocompact com contagem de tokens, /clear ao mudar de assunto, subagente em janela isolada e /rewind pra restaurar código, conversa ou os dois

Fala aí, beleza? Sabe aquela sessão que começa afiada, ele lê o projeto, respeita tudo que você combinou e acerta o arquivo de primeira? Aí, duas horas depois, o mesmo agente te pergunta de novo qual é o banco que você usa 🙂

Não, ele não ficou burro no meio do caminho

o que aconteceu é que a janela encheu, e aquilo que você explicou lá no começo virou a primeira coisa a ser espremida

Neste post eu te conto o que ocupa espaço no contexto do Claude Code (spoiler: MUITO mais coisa do que você digitou), quais sinais mostram que ele está perdendo referência, e o que dá pra fazer pra aliviar o peso sem jogar a sessão inteira fora

Bora ver na prática?

Domine o Claude Code do básico ao avançado
Pré-inscrição Formação Claude Code

Domine o Claude Code do básico ao avançado

Você vai aprender a criar sistemas completos com Claude Code, sem precisar ser programador. Inscreva-se para ter acesso a um desconto de lançamento e bônus especiais!

O que ocupa espaço na janela antes mesmo de você digitar

A janela de contexto guarda tudo que o modelo sabe da sessão

E "tudo" aqui é literal: as instruções, os arquivos que ele leu, as respostas dele mesmo e conteúdo que nunca aparece no terminal pra você

"Conteúdo invisível?" Sim, tem coisa disputando o mesmo espaço sem passar pela sua tela

Se você conhece a ideia de RAM de máquina, a analogia é quase direta: é um espaço fixo, e cada coisa que entra tira lugar de outra

Agora se liga na parte que pega a maioria de surpresa

Antes de você digitar a primeira letra, já entram em contexto:

  • o CLAUDE.md
  • a memória automática
  • os nomes das ferramentas MCP
  • as descrições das skills

Ou seja: sessão nova NÃO é sessão vazia

É como sair pra viagem com a mala já pela metade: cabe menos roupa nova

Espaço ocupado por bagagem fixa é espaço que falta pro arquivo que você quer que ele leia AGORA

Como medir o consumo real da sua sessão com /context

Chega de achismo, o Claude Code tem um comando que te mostra isso ao vivo

  1. Abra a sessão que você quer diagnosticar e rode o comando de contexto dentro do Claude Code:
/context
  1. Leia a quebra por categoria que ele devolve, e não a sua impressão da conversa

O erro comum deste passo é justamente esse: chutar que "está cheio" pelo tamanho do papo visível no terminal, quando a maior fatia costuma estar em categorias que você nunca viu rolar na tela

  1. Olhe as sugestões de otimização que o próprio comando traz

Elas apontam pra onde o corte rende, em vez de você sair apagando coisa no escuro

  1. Confira quais arquivos CLAUDE.md e de memória automática foram carregados

Tome cuidado aqui: é comum carregar memória de projeto que não tem nada a ver com o que você vai fazer hoje

  1. Só depois disso decida o que fazer: focar, limpar ou empurrar o trabalho pesado pra um subagente

Diagnóstico primeiro, remédio depois 😀

Sinais de que o Claude Code está perdendo o fio da tarefa

O agente não avisa "olha, esqueci"

Ele continua respondendo com a maior confiança do mundo, e os sintomas aparecem no comportamento

Ele repete um trabalho que já fez

Causa provável: o trecho da conversa onde aquilo foi resolvido já foi espremido ou resumido

Solução: em vez de brigar no papo, rode /compact com instrução de foco na tarefa atual, pra que o resumo carregue o que importa

Ele volta a pedir contexto que você já deu

Causa provável: a informação estava só no meio do papo, e o papo antigo é sempre a primeira vítima

Solução: o que é regra fixa não vive no chat, vive no CLAUDE.md, que entra em contexto no início da sessão

Ele ignora uma regra combinada lá no começo

Causa provável: a compactação automática já passou por cima do combinado

A compactação existe justamente pra estender o comprimento efetivo do contexto em conversas longas, resumindo o contexto mais antigo quando você se aproxima do limite da janela

Isso é bom (a sessão não morre), mas o resumo é um resumo: o que não entrou nele não está mais lá

Ele reintroduz um arquivo que você já corrigiu

Causa provável: mistura de assuntos na mesma sessão, com duas versões da mesma coisa disputando espaço

Solução: /clear ao trocar pra um trabalho não relacionado, tirando a conversa velha que espreme os arquivos que você precisa a seguir

A prevenção é bem mais barata que o conserto: limpa ao mudar de assunto, compacta com foco ANTES de a passada automática decidir sozinha o que é importante, e sobe pro CLAUDE.md tudo que for regra permanente

/compact, /clear, /autocompact, subagente e /rewind: qual usar em cada situação

Esses recursos parecem intercambiáveis e não são, cada um faz uma coisa diferente com a sua conversa

Se você quiser a versão mão na massa de gerenciar contexto no Claude Code, tem um post do blog só sobre isso

RecursoQuando usarO que faz com a conversaLimite importante
/compactSessão longa na MESMA tarefaSubstitui a conversa por um resumo estruturado, e aceita instrução de focoO que não entra no resumo não fica na conversa
/autocompactQuando você quer mandar no gatilhoRecebe uma contagem de tokens e define quão cheia a janela fica antes de a passada automática rodarDefine QUANDO resume, não impede o resumo
/clearAo mudar pra um trabalho não relacionadoTira a conversa velha que espreme os arquivos necessários a seguirNão serve pra pausa dentro da mesma tarefa
SubagenteExploração pesada, leitura em volumeRoda em janela de contexto isolada, com system prompt e ferramentas próprios, e devolve só um resultado ao thread principalO caminho da exploração não fica na conversa principal, só o resultado
/rewindQuando quer voltar no tempoAbre o menu de checkpoint e permite restaurar código, conversa ou os doisCobre só as edições de arquivo feitas pelo próprio agente

Dois detalhes que valem ouro no dia a dia

O primeiro: o /compact com foco é escrito assim

/compact focus on the auth bug fix

O segundo: o /autocompact recebe a contagem de tokens direto

/autocompact 500k

E o /rewind também abre apertando Esc duas vezes com o campo de entrada vazio

Só não confie nele como desfazer universal: mudança feita por comando bash, alteração externa, operação de diretório e banco de dados NÃO voltam

Já me ferrei uma vez achando que "volta tudo" 😛

Três situações comuns e a saída certa para cada uma

Na prática, a escolha quase sempre cai em um destes três cenários

Sessão longa no mesmo bug

Você está há horas no mesmo problema, o histórico está gigante, mas TUDO ali é relevante

Aqui limpar é tiro no pé: você joga fora o raciocínio que te trouxe até aqui

Compacta com foco na tarefa e segue

Troca pra outro projeto ou outra feature

Agora é o contrário: o histórico não só é inútil, ele atrapalha

O agente continua puxando referência do assunto anterior, e ainda ocupa espaço que o novo arquivo precisa

Limpa e recomeça a conversa, mantendo o que é permanente no CLAUDE.md

Exploração pesada de repositório grande

Varrer um monorepo inteiro na conversa principal é a receita clássica pra estourar tudo antes de escrever a primeira linha de código

Empurra a leitura pro subagente: ele roda em janela própria e devolve só o resultado pro thread principal

A conversa principal fica leve, com a conclusão em vez do caminho todo

E tem a escolha do modelo também

O Claude Code tem aliases de contexto estendido: sonnet[1m], opus[1m] e opusplan

A janela de 1 milhão de tokens é suportada em Fable 5, Sonnet 5, Sonnet 4.6 e Opus 4.6 em diante, e no Sonnet 5 e no Opus 5 esse 1M é ao mesmo tempo o padrão e o máximo, sem variante de contexto menor

Sobre a conta: a janela de 1M usa o preço padrão do modelo, sem prêmio pros tokens acima de 200 mil, e nos planos em que o contexto estendido está incluído o uso segue coberto pela assinatura (se você quer o panorama de preço do Claude Code no Brasil, tem post separado sobre isso)

A disponibilidade geral do contexto de 1M para Opus 4.6 e Sonnet 4.6 já inclui o Claude Code

Conclusão

O teto é alto, e ficou mais alto ainda com a janela de 1M

Mas veredito honesto: o número da janela não é o que decide a qualidade da sua sessão

Quem decide é a higiene de contexto, ou seja, o que você deixa entrar, o que você resume com foco e o que você manda pra outra janela

Janela grande com bagunça dentro só demora mais pra dar problema, ela não deixa de dar

Próximo passo, bem concreto: abre a sessão de trabalho de hoje, roda /context ANTES de pedir a próxima tarefa, e decide pela quebra por categoria se o caso é foco, limpeza ou subagente

Faça o teste, é bem provável que a maior fatia não seja o que você imaginava 😀

até o próximo post!

Perguntas frequentes

Quantos tokens de contexto o Claude Code aguenta hoje?

Depende do modelo. Sonnet 5 e Opus 5 trabalham com 1 milhão de tokens como padrão e também como máximo, sem variante menor de 200K. O mesmo patamar de 1M vale para Fable 5, Sonnet 4.6 e Opus 4.6 em diante, com disponibilidade geral já anunciada pela Anthropic.

O contexto de 1 milhão de tokens no Claude Code custa mais caro?

Não. A janela de 1M usa o preço padrão do modelo, sem prêmio para os tokens que passam de 200 mil. Nos planos em que o contexto estendido já está incluído, o uso continua coberto pela própria assinatura.

O /rewind desfaz qualquer mudança feita durante a sessão?

Não, a cobertura é limitada. O checkpointing do Claude Code, acessado por /rewind ou apertando Esc duas vezes com o campo vazio, restaura código, conversa ou os dois, mas só cobre as edições de arquivo feitas pelo próprio agente. Mudanças por comando bash, alterações externas, operações de diretório e bancos de dados não voltam.

Subagente do Claude Code consome o contexto da conversa principal?

Não. Cada subagente roda numa janela de contexto isolada, com system prompt e lista de ferramentas próprios, e devolve só um resultado pra thread principal. Por isso o caminho da exploração pesada não fica acumulando espaço na conversa que você está vendo.

O que são os aliases sonnet[1m], opus[1m] e opusplan?

São aliases de modelo do Claude Code voltados a contexto estendido. Eles existem justamente porque Sonnet e Opus nas versões mais recentes já suportam a janela de 1 milhão de tokens, então esses aliases dão acesso direto a esse modo dentro da ferramenta.

O /autocompact desliga a compactação automática do Claude Code?

Não, ele não desliga, só ajusta o gatilho. O comando recebe uma contagem de tokens, como em /autocompact 500k, e define quão cheia a janela pode ficar antes de a passada automática rodar sozinha.



Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares