Quanto contexto o Claude Code aguenta antes de perder o fio da tarefa?

O contexto do Claude Code não é só o que você digitou: a janela guarda as instruções, os arquivos lidos, as respostas do próprio agente e conteúdo que nunca aparece no terminal. CLAUDE.md, memória automática, nomes de ferramentas MCP e descrições de skills já entram no início da sessão. Pra saber quanto sobrou, rode /context e leia a quebra por categoria. Pra aliviar sem recomeçar do zero: /compact com foco, /autocompact com contagem de tokens, /clear ao mudar de assunto, subagente em janela isolada e /rewind pra restaurar código, conversa ou os dois
Fala aí, beleza? Sabe aquela sessão que começa afiada, ele lê o projeto, respeita tudo que você combinou e acerta o arquivo de primeira? Aí, duas horas depois, o mesmo agente te pergunta de novo qual é o banco que você usa 🙂
Não, ele não ficou burro no meio do caminho
o que aconteceu é que a janela encheu, e aquilo que você explicou lá no começo virou a primeira coisa a ser espremida
Neste post eu te conto o que ocupa espaço no contexto do Claude Code (spoiler: MUITO mais coisa do que você digitou), quais sinais mostram que ele está perdendo referência, e o que dá pra fazer pra aliviar o peso sem jogar a sessão inteira fora
Bora ver na prática?
Domine o Claude Code do básico ao avançado
Você vai aprender a criar sistemas completos com Claude Code, sem precisar ser programador. Inscreva-se para ter acesso a um desconto de lançamento e bônus especiais!
O que ocupa espaço na janela antes mesmo de você digitar
A janela de contexto guarda tudo que o modelo sabe da sessão
E "tudo" aqui é literal: as instruções, os arquivos que ele leu, as respostas dele mesmo e conteúdo que nunca aparece no terminal pra você
"Conteúdo invisível?" Sim, tem coisa disputando o mesmo espaço sem passar pela sua tela
Se você conhece a ideia de RAM de máquina, a analogia é quase direta: é um espaço fixo, e cada coisa que entra tira lugar de outra
Agora se liga na parte que pega a maioria de surpresa
Antes de você digitar a primeira letra, já entram em contexto:
- o
CLAUDE.md - a memória automática
- os nomes das ferramentas MCP
- as descrições das skills
Ou seja: sessão nova NÃO é sessão vazia
É como sair pra viagem com a mala já pela metade: cabe menos roupa nova
Espaço ocupado por bagagem fixa é espaço que falta pro arquivo que você quer que ele leia AGORA
Como medir o consumo real da sua sessão com /context
Chega de achismo, o Claude Code tem um comando que te mostra isso ao vivo
- Abra a sessão que você quer diagnosticar e rode o comando de contexto dentro do Claude Code:
/context
- Leia a quebra por categoria que ele devolve, e não a sua impressão da conversa
O erro comum deste passo é justamente esse: chutar que "está cheio" pelo tamanho do papo visível no terminal, quando a maior fatia costuma estar em categorias que você nunca viu rolar na tela
- Olhe as sugestões de otimização que o próprio comando traz
Elas apontam pra onde o corte rende, em vez de você sair apagando coisa no escuro
- Confira quais arquivos
CLAUDE.mde de memória automática foram carregados
Tome cuidado aqui: é comum carregar memória de projeto que não tem nada a ver com o que você vai fazer hoje
- Só depois disso decida o que fazer: focar, limpar ou empurrar o trabalho pesado pra um subagente
Diagnóstico primeiro, remédio depois 😀
Sinais de que o Claude Code está perdendo o fio da tarefa
O agente não avisa "olha, esqueci"
Ele continua respondendo com a maior confiança do mundo, e os sintomas aparecem no comportamento
Ele repete um trabalho que já fez
Causa provável: o trecho da conversa onde aquilo foi resolvido já foi espremido ou resumido
Solução: em vez de brigar no papo, rode /compact com instrução de foco na tarefa atual, pra que o resumo carregue o que importa
Ele volta a pedir contexto que você já deu
Causa provável: a informação estava só no meio do papo, e o papo antigo é sempre a primeira vítima
Solução: o que é regra fixa não vive no chat, vive no CLAUDE.md, que entra em contexto no início da sessão
Ele ignora uma regra combinada lá no começo
Causa provável: a compactação automática já passou por cima do combinado
A compactação existe justamente pra estender o comprimento efetivo do contexto em conversas longas, resumindo o contexto mais antigo quando você se aproxima do limite da janela
Isso é bom (a sessão não morre), mas o resumo é um resumo: o que não entrou nele não está mais lá
Ele reintroduz um arquivo que você já corrigiu
Causa provável: mistura de assuntos na mesma sessão, com duas versões da mesma coisa disputando espaço
Solução: /clear ao trocar pra um trabalho não relacionado, tirando a conversa velha que espreme os arquivos que você precisa a seguir
A prevenção é bem mais barata que o conserto: limpa ao mudar de assunto, compacta com foco ANTES de a passada automática decidir sozinha o que é importante, e sobe pro CLAUDE.md tudo que for regra permanente
/compact, /clear, /autocompact, subagente e /rewind: qual usar em cada situação
Esses recursos parecem intercambiáveis e não são, cada um faz uma coisa diferente com a sua conversa
Se você quiser a versão mão na massa de gerenciar contexto no Claude Code, tem um post do blog só sobre isso
| Recurso | Quando usar | O que faz com a conversa | Limite importante |
|---|---|---|---|
/compact |
Sessão longa na MESMA tarefa | Substitui a conversa por um resumo estruturado, e aceita instrução de foco | O que não entra no resumo não fica na conversa |
/autocompact |
Quando você quer mandar no gatilho | Recebe uma contagem de tokens e define quão cheia a janela fica antes de a passada automática rodar | Define QUANDO resume, não impede o resumo |
/clear |
Ao mudar pra um trabalho não relacionado | Tira a conversa velha que espreme os arquivos necessários a seguir | Não serve pra pausa dentro da mesma tarefa |
| Subagente | Exploração pesada, leitura em volume | Roda em janela de contexto isolada, com system prompt e ferramentas próprios, e devolve só um resultado ao thread principal | O caminho da exploração não fica na conversa principal, só o resultado |
/rewind |
Quando quer voltar no tempo | Abre o menu de checkpoint e permite restaurar código, conversa ou os dois | Cobre só as edições de arquivo feitas pelo próprio agente |
Dois detalhes que valem ouro no dia a dia
O primeiro: o /compact com foco é escrito assim
/compact focus on the auth bug fix
O segundo: o /autocompact recebe a contagem de tokens direto
/autocompact 500k
E o /rewind também abre apertando Esc duas vezes com o campo de entrada vazio
Só não confie nele como desfazer universal: mudança feita por comando bash, alteração externa, operação de diretório e banco de dados NÃO voltam
Já me ferrei uma vez achando que "volta tudo" 😛
Três situações comuns e a saída certa para cada uma
Na prática, a escolha quase sempre cai em um destes três cenários
Sessão longa no mesmo bug
Você está há horas no mesmo problema, o histórico está gigante, mas TUDO ali é relevante
Aqui limpar é tiro no pé: você joga fora o raciocínio que te trouxe até aqui
Compacta com foco na tarefa e segue
Troca pra outro projeto ou outra feature
Agora é o contrário: o histórico não só é inútil, ele atrapalha
O agente continua puxando referência do assunto anterior, e ainda ocupa espaço que o novo arquivo precisa
Limpa e recomeça a conversa, mantendo o que é permanente no CLAUDE.md
Exploração pesada de repositório grande
Varrer um monorepo inteiro na conversa principal é a receita clássica pra estourar tudo antes de escrever a primeira linha de código
Empurra a leitura pro subagente: ele roda em janela própria e devolve só o resultado pro thread principal
A conversa principal fica leve, com a conclusão em vez do caminho todo
E tem a escolha do modelo também
O Claude Code tem aliases de contexto estendido: sonnet[1m], opus[1m] e opusplan
A janela de 1 milhão de tokens é suportada em Fable 5, Sonnet 5, Sonnet 4.6 e Opus 4.6 em diante, e no Sonnet 5 e no Opus 5 esse 1M é ao mesmo tempo o padrão e o máximo, sem variante de contexto menor
Sobre a conta: a janela de 1M usa o preço padrão do modelo, sem prêmio pros tokens acima de 200 mil, e nos planos em que o contexto estendido está incluído o uso segue coberto pela assinatura (se você quer o panorama de preço do Claude Code no Brasil, tem post separado sobre isso)
A disponibilidade geral do contexto de 1M para Opus 4.6 e Sonnet 4.6 já inclui o Claude Code
Conclusão
O teto é alto, e ficou mais alto ainda com a janela de 1M
Mas veredito honesto: o número da janela não é o que decide a qualidade da sua sessão
Quem decide é a higiene de contexto, ou seja, o que você deixa entrar, o que você resume com foco e o que você manda pra outra janela
Janela grande com bagunça dentro só demora mais pra dar problema, ela não deixa de dar
Próximo passo, bem concreto: abre a sessão de trabalho de hoje, roda /context ANTES de pedir a próxima tarefa, e decide pela quebra por categoria se o caso é foco, limpeza ou subagente
Faça o teste, é bem provável que a maior fatia não seja o que você imaginava 😀
até o próximo post!
Perguntas frequentes
Quantos tokens de contexto o Claude Code aguenta hoje?
Depende do modelo. Sonnet 5 e Opus 5 trabalham com 1 milhão de tokens como padrão e também como máximo, sem variante menor de 200K. O mesmo patamar de 1M vale para Fable 5, Sonnet 4.6 e Opus 4.6 em diante, com disponibilidade geral já anunciada pela Anthropic.
O contexto de 1 milhão de tokens no Claude Code custa mais caro?
Não. A janela de 1M usa o preço padrão do modelo, sem prêmio para os tokens que passam de 200 mil. Nos planos em que o contexto estendido já está incluído, o uso continua coberto pela própria assinatura.
O /rewind desfaz qualquer mudança feita durante a sessão?
Não, a cobertura é limitada. O checkpointing do Claude Code, acessado por /rewind ou apertando Esc duas vezes com o campo vazio, restaura código, conversa ou os dois, mas só cobre as edições de arquivo feitas pelo próprio agente. Mudanças por comando bash, alterações externas, operações de diretório e bancos de dados não voltam.
Subagente do Claude Code consome o contexto da conversa principal?
Não. Cada subagente roda numa janela de contexto isolada, com system prompt e lista de ferramentas próprios, e devolve só um resultado pra thread principal. Por isso o caminho da exploração pesada não fica acumulando espaço na conversa que você está vendo.
O que são os aliases sonnet[1m], opus[1m] e opusplan?
São aliases de modelo do Claude Code voltados a contexto estendido. Eles existem justamente porque Sonnet e Opus nas versões mais recentes já suportam a janela de 1 milhão de tokens, então esses aliases dão acesso direto a esse modo dentro da ferramenta.
O /autocompact desliga a compactação automática do Claude Code?
Não, ele não desliga, só ajusta o gatilho. O comando recebe uma contagem de tokens, como em /autocompact 500k, e define quão cheia a janela pode ficar antes de a passada automática rodar sozinha.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
As diferenças de var, let e const
Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]
ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
