Claude Code limits: como funcionam os limites de uso e por que você é bloqueado no meio do trabalho

Claude Code limits funcionam em duas camadas empilhadas: uma janela de sessão de 5 horas, que começa a contar na sua primeira mensagem e reinicia sozinha, e um limite semanal nos planos pagos, que reinicia em dia e horário fixos atribuídos à sua conta. Nos planos Max são dois tetos semanais, um geral e um só de Sonnet. O consumo é somado entre Claude, Claude Code e as IDEs suportadas. O que mais queima cota é o histórico da conversa, reenviado a cada nova mensagem. Dá pra acompanhar tudo em Settings > Usage e pelo comando /usage
Você tá no meio de um refactor, o Claude Code rodando redondo, e do nada aparece uma mensagem avisando que o limite acabou
Não é bug
Não é banimento
E também não é aquela história de "usei demais e fui punido"
O que existe ali é um sistema de limites EMPILHADOS: uma janela de sessão que anda sozinha e um teto semanal que reinicia num horário fixo da sua conta
Neste post eu destrincho como funcionam os Claude Code limits, o que costuma queimar cota mais rápido dentro de uma sessão e como enxergar o seu consumo antes de bater no teto 🙂
Por que o Claude Code tem limite de uso
A resposta curta: capacidade de computação é finita e é compartilhada por todo mundo que tá usando a ferramenta ao mesmo tempo
O limite não é um castigo, é uma função da infra disponível
Domine o Claude Code do básico ao avançado
Você vai aprender a criar sistemas completos com Claude Code, sem precisar ser programador. Inscreva-se para ter acesso a um desconto de lançamento e bônus especiais!
E dá pra ver isso na prática quando a infra cresce
Em 6 de maio de 2026 a Anthropic dobrou os limites de 5 horas do Claude Code para as contas Pro, Max, Team e Enterprise por assento, e ainda removeu a redução de limite em horário de pico para contas Pro e Max
O motivo declarado foi um acordo de computação com a SpaceX pelo data center Colossus 1: mais de 300 megawatts de nova capacidade (mais de 220.000 GPUs NVIDIA) dentro do mês
Ou seja: entrou capacidade, subiu o teto
Entender isso já muda o jeito de encarar o bloqueio, porque a pergunta deixa de ser "por que me barraram?" e vira "quanto do meu saldo eu tô queimando à toa?"
Os dois limites empilhados: sessão de 5 horas e limite semanal
Aqui mora a maior parte da confusão
Não existe UM limite, existem dois rodando ao mesmo tempo
| Camada | Como funciona | Quando reinicia |
|---|---|---|
| Limite de sessão | janela contínua de 5 horas | sozinha, ao fim da janela |
| Limite semanal (planos pagos) | teto da semana da sua conta | dia e horário fixos atribuídos à conta |
A janela de 5 horas:
Ela é contínua e começa a contar a partir da PRIMEIRA mensagem que você envia, não em horário redondo do relógio
Então não adianta esperar "virar a hora"
Se você mandou a primeira mensagem às 9h47, é essa a âncora da sua janela
E ela reinicia sozinha, sem você fazer nada
O limite semanal:
Esse reinicia em um dia e horário fixos, atribuídos individualmente à sua conta
Nos planos Max tem um detalhe que pega muita gente: são DOIS limites semanais separados, um que vale para todos os modelos e outro só para modelos Sonnet
Sobre os níveis: o Max 5x entrega 5x o uso do Pro por sessão, e o Max 20x entrega 20x
O ponto que mais confunde:
O consumo é compartilhado
O uso no Claude e no Claude Code, inclusive nas IDEs suportadas (VS Code, forks do VS Code e IDEs JetBrains), conta para os MESMOS limites
Traduzindo: aquela conversa longa que você teve no chat de manhã derrubou o saldo do seu terminal à tarde
Se você trabalha nos dois lugares e nunca ligou um no outro, provavelmente é aqui que sua cota tá sumindo
O que consome mais rápido numa sessão de Claude Code
O sintoma é sempre o mesmo: a sessão começou tranquila, você tava produzindo, e em uma hora ela travou
E a causa quase nunca é "mandei mensagem demais"
O histórico é o vilão principal:
Numa sessão longa, tudo que já foi lido e produzido é reenviado a cada nova mensagem
É daí que vem o grosso do consumo
Sua vigésima pergunta não custa o que uma pergunta custa, ela custa a pergunta MAIS todo o acumulado da conversa até ali
Por isso a sensação de que a sessão "acelera" pro fim: cada turno fica mais caro que o anterior
Ferramentas, conectores e nível de esforço:
Ferramentas e conectores ativos são pesados em tokens, porque ficam no contexto o tempo todo
Se você deixou tudo ligado por conveniência, tá pagando por tudo em toda mensagem
Vale a pena revisar quais ferramentas externas via MCP a tarefa daquele momento realmente exige
E tem o nível de esforço (effort), que controla quanto raciocínio o modelo aplica: esforço maior gasta mais tokens
"Mas e o cache?"
Essa é a dúvida clássica, e a resposta é meio contraintuitiva
A partir do segundo turno, o conteúdo repetido é cobrado na tarifa de leitura de cache, que é mais barata
Porém ele CONTINUA ocupando espaço da janela de contexto em toda mensagem
Cache reduz o custo, não reduz o espaço ocupado
Então não conte com ele pra segurar uma sessão inflada
A prevenção mais simples:
O comando /clear limpa a conversa e recomeça do zero mantendo os arquivos do projeto disponíveis
Ele é indicado justamente na troca de tarefa
/clearTerminou de mexer no login e vai pro layout? Limpa
Arrastar o histórico da tarefa anterior é pagar caro por contexto que não serve mais pra nada
Como ver quanto você já consumiu (antes de ser bloqueado)
Dá pra acompanhar o consumo em vez de descobrir no susto
São caminhos diferentes, e cada um serve pra uma coisa
- Abra Settings > Usage nas configurações da sua conta Claude
Nas contas Pro, Max, Team e Enterprise por assento, essa seção mostra barras de progresso do limite de sessão de 5 horas e dos limites semanais
É a visão mais completa, porque você vê as duas camadas lado a lado
- Dentro do Claude Code, rode
/usagepra ver o uso atual
/usageEsse é o comando pra consultar sem sair do terminal, no meio do trabalho
- Use
/costse você autentica por chave de API
/costEle mostra o gasto corrente da sessão nesse tipo de autenticação
- Rode
/usage-creditsdepois de entrar com a assinatura
/login
/usage-creditsO erro comum deste passo: procurar o /usage-credits estando autenticado por chave de API
Ele só fica disponível depois de entrar com a assinatura via /login e não funciona na autenticação por chave de API
Se ele não aparece pra você, é bem provável que seja isso, e não um problema na instalação
Bati no limite: o que a mensagem quer dizer e o que fazer
A mensagem que aparece ao bater no teto MUDA conforme os créditos de uso estejam ligados ou não
E as duas são bem diferentes na prática
Sem créditos de uso:
5-hour limit reached - resets [horário]Aqui o trabalho para de verdade até o horário indicado
É o bloqueio clássico, aquele que pega você no meio da tarefa
Com créditos de uso ligados:
5-hour limit resets [horário] - continuing with usage creditsRepara na diferença: essa segunda mensagem AVISA o horário do reset, mas a sessão segue rodando
E o que são esses créditos de uso?
Eles estão disponíveis para Pro, Max 5x e Max 20x, e permitem continuar trabalhando depois de estourar o limite incluso, passando a pagar por consumo nas tarifas padrão de API
Valem tanto para o Claude quanto para o Claude Code no terminal
Tem um detalhe prático bom: nos planos Pro e Max, ao atingir o limite de gasto com créditos ainda disponíveis, o próprio Claude Code oferece aumentar ou remover esse limite sem você sair da CLI
Ou seja, a decisão de continuar pagando por consumo acontece ali mesmo, no fluxo
Tome cuidado com isso, beleza? Continuar rodando é ótimo pro prazo, mas é bom saber que a partir dali a conta muda de natureza
O que aconteceu quando reduzi o que entra na conversa
Se o histórico acumulado é o principal vetor de consumo, a conclusão prática é direta: quanto menos texto entra na conversa, mais a sessão dura
E tem um lugar onde entra MUITO texto sem ninguém perceber: a saída dos comandos que a IA roda no terminal por conta própria
Você pede uma tarefa qualquer e ela dispara verificações sozinha, e cada saída dessas volta pro contexto
Pra medir esse efeito eu gravei um teste pro vídeo do canal: mesmo projeto, mesmo prompt, rodado duas vezes, sendo a segunda rodada com uma ferramenta gratuita ligada, que enxuga essa saída de comandos antes dela entrar no contexto
Instalação e configuração dela eu não vou detalhar aqui, porque é justamente o assunto do vídeo, onde dá pra ver tudo na tela
O prompt foi propositalmente pesado em comandos: contar arquivos, listar dependências, checar testes, rodar instalação e build, verificar o estado do versionamento
O que deu, na minha máquina:
- rodada sem a ferramenta: cerca de 2 minutos e pouco
- mesma rodada com a ferramenta ligada: cerca de 1 minuto
- comando que mais economizou no relatório (a listagem de arquivos): 75% de tokens economizados
- economia total daquela sessão de teste, segundo o relatório da ferramenta: 33%
E olha, preciso ser honesto: foi um cenário rígido e artificial, sem funcionalidade real sendo construída
No uso diário, com comandos mais pesados e projeto em andamento, a tendência é a economia ser maior
Mas o mecanismo é exatamente o que a gente já explicou lá em cima: menos texto reenviado por mensagem, menos consumo por turno
No vídeo abaixo eu mostro a rodada comparada na tela, com os comandos disparando em sequência e o relatório no fim
Rotinas que fazem a sessão render mais
Nada de fórmula mágica aqui, é só traduzir o mecanismo em hábito
/clearao trocar de tarefa: em vez de arrastar o histórico da tarefa anterior por mais 40 mensagens, zera a conversa (os arquivos do projeto continuam disponíveis)- Só as ferramentas e conectores que a tarefa exige: eles estão no contexto o tempo todo, então cada extra ligado é imposto fixo
- Calibrar o nível de esforço pela dificuldade real: esforço alto é ótimo pra problema cabeludo, é desperdício pra ajuste bobo
- Prompt mais fechado desde o começo: pedido vago gera ida e volta, e ida e volta é histórico acumulado (vale revisar suas técnicas de prompt no Claude Code)
- Rodar
/usageantes de abrir uma frente longa: descobrir que sobrou pouco ANTES de começar o refactor é bem melhor que descobrir no meio - Lembrar que chat e IDE bebem do mesmo saldo: se você passou a manhã no Claude, o terminal já começa a tarde com menos margem
Resumo e o que fazer agora
Recapitulando o essencial
São dois limites empilhados: a janela contínua de 5 horas, que começa na sua primeira mensagem e reinicia sozinha, e o limite semanal dos planos pagos, com reset em dia e horário fixos da sua conta (e nos planos Max, dois tetos semanais separados, um geral e um de Sonnet)
O principal vetor de consumo é o histórico acumulado, reenviado a cada nova mensagem
E o consumo é compartilhado entre Claude, Claude Code e as IDEs suportadas
O próximo passo é bem simples: na sua próxima sessão, roda /usage antes de começar e usa /clear toda vez que virar de tarefa
Só com esses dois hábitos você já para de ser surpreendido pelo bloqueio no pior momento possível
até o próximo post! 😀
Perguntas frequentes
Quando o limite de 5 horas do Claude Code reinicia?
A janela de 5 horas é contínua e começa a contar a partir da primeira mensagem que você envia na sessão, não em horário fixo do relógio. Ela reinicia sozinha ao fim dessas 5 horas, sem precisar de nenhuma ação sua.
O limite do Claude Code no plano Max é igual ao do Pro?
Não. O Max 5x entrega 5x o uso do Pro por sessão e o Max 20x entrega 20x. Além disso, os planos Max têm dois limites semanais separados: um geral, para todos os modelos, e outro específico para modelos Sonnet.
Usar o Claude pelo navegador consome o mesmo limite do Claude Code?
Sim. Os limites são únicos e somam o uso no Claude, no Claude Code e nas IDEs suportadas (VS Code, forks do VS Code e IDEs JetBrains). Uma conversa longa no chat pode reduzir o saldo disponível pro terminal no mesmo dia.
Dá pra continuar usando o Claude Code depois de bater no limite?
Depende do plano e dos créditos de uso. Assinantes de Pro, Max 5x e Max 20x podem seguir trabalhando após estourar o limite incluso, pagando por consumo na tarifa padrão de API, tanto no Claude quanto no Claude Code no terminal. Nos planos Pro e Max, ao atingir o limite de gasto com créditos ainda disponíveis, o próprio Claude Code oferece aumentar ou remover esse limite sem sair da CLI.
Por que o /usage-credits não aparece no meu Claude Code?
Esse comando só fica disponível depois de entrar com a assinatura via /login, e não funciona na autenticação por chave de API. Se você autentica por chave de API, o caminho certo pra acompanhar o gasto é o /cost.
O comando /clear devolve o limite já consumido no Claude Code?
Não devolve cota gasta, mas evita que ela suba à toa dali pra frente. O /clear limpa o histórico da conversa e recomeça do zero mantendo os arquivos do projeto disponíveis, o que ajuda porque o histórico acumulado é reenviado a cada mensagem e é o principal vetor de consumo dentro de uma sessão.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares

As diferenças de var, let e const

Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]

ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
