Claude Code limits: como funcionam os limites de uso e por que você é bloqueado no meio do trabalho

como funcionam os limites de uso do Claude Code
Resposta rápida

Claude Code limits funcionam em duas camadas empilhadas: uma janela de sessão de 5 horas, que começa a contar na sua primeira mensagem e reinicia sozinha, e um limite semanal nos planos pagos, que reinicia em dia e horário fixos atribuídos à sua conta. Nos planos Max são dois tetos semanais, um geral e um só de Sonnet. O consumo é somado entre Claude, Claude Code e as IDEs suportadas. O que mais queima cota é o histórico da conversa, reenviado a cada nova mensagem. Dá pra acompanhar tudo em Settings > Usage e pelo comando /usage

Você tá no meio de um refactor, o Claude Code rodando redondo, e do nada aparece uma mensagem avisando que o limite acabou

Não é bug

Não é banimento

E também não é aquela história de "usei demais e fui punido"

O que existe ali é um sistema de limites EMPILHADOS: uma janela de sessão que anda sozinha e um teto semanal que reinicia num horário fixo da sua conta

Neste post eu destrincho como funcionam os Claude Code limits, o que costuma queimar cota mais rápido dentro de uma sessão e como enxergar o seu consumo antes de bater no teto 🙂

Por que o Claude Code tem limite de uso

A resposta curta: capacidade de computação é finita e é compartilhada por todo mundo que tá usando a ferramenta ao mesmo tempo

O limite não é um castigo, é uma função da infra disponível

Domine o Claude Code do básico ao avançado
Pré-inscrição Formação Claude Code

Domine o Claude Code do básico ao avançado

Você vai aprender a criar sistemas completos com Claude Code, sem precisar ser programador. Inscreva-se para ter acesso a um desconto de lançamento e bônus especiais!

E dá pra ver isso na prática quando a infra cresce

Em 6 de maio de 2026 a Anthropic dobrou os limites de 5 horas do Claude Code para as contas Pro, Max, Team e Enterprise por assento, e ainda removeu a redução de limite em horário de pico para contas Pro e Max

O motivo declarado foi um acordo de computação com a SpaceX pelo data center Colossus 1: mais de 300 megawatts de nova capacidade (mais de 220.000 GPUs NVIDIA) dentro do mês

Ou seja: entrou capacidade, subiu o teto

Entender isso já muda o jeito de encarar o bloqueio, porque a pergunta deixa de ser "por que me barraram?" e vira "quanto do meu saldo eu tô queimando à toa?"

Os dois limites empilhados: sessão de 5 horas e limite semanal

Aqui mora a maior parte da confusão

Não existe UM limite, existem dois rodando ao mesmo tempo

Camada Como funciona Quando reinicia
Limite de sessão janela contínua de 5 horas sozinha, ao fim da janela
Limite semanal (planos pagos) teto da semana da sua conta dia e horário fixos atribuídos à conta

A janela de 5 horas:

Ela é contínua e começa a contar a partir da PRIMEIRA mensagem que você envia, não em horário redondo do relógio

Então não adianta esperar "virar a hora"

Se você mandou a primeira mensagem às 9h47, é essa a âncora da sua janela

E ela reinicia sozinha, sem você fazer nada

O limite semanal:

Esse reinicia em um dia e horário fixos, atribuídos individualmente à sua conta

Nos planos Max tem um detalhe que pega muita gente: são DOIS limites semanais separados, um que vale para todos os modelos e outro só para modelos Sonnet

Sobre os níveis: o Max 5x entrega 5x o uso do Pro por sessão, e o Max 20x entrega 20x

O ponto que mais confunde:

O consumo é compartilhado

O uso no Claude e no Claude Code, inclusive nas IDEs suportadas (VS Code, forks do VS Code e IDEs JetBrains), conta para os MESMOS limites

Traduzindo: aquela conversa longa que você teve no chat de manhã derrubou o saldo do seu terminal à tarde

Se você trabalha nos dois lugares e nunca ligou um no outro, provavelmente é aqui que sua cota tá sumindo

O que consome mais rápido numa sessão de Claude Code

O sintoma é sempre o mesmo: a sessão começou tranquila, você tava produzindo, e em uma hora ela travou

E a causa quase nunca é "mandei mensagem demais"

O histórico é o vilão principal:

Numa sessão longa, tudo que já foi lido e produzido é reenviado a cada nova mensagem

É daí que vem o grosso do consumo

Sua vigésima pergunta não custa o que uma pergunta custa, ela custa a pergunta MAIS todo o acumulado da conversa até ali

Por isso a sensação de que a sessão "acelera" pro fim: cada turno fica mais caro que o anterior

Ferramentas, conectores e nível de esforço:

Ferramentas e conectores ativos são pesados em tokens, porque ficam no contexto o tempo todo

Se você deixou tudo ligado por conveniência, tá pagando por tudo em toda mensagem

Vale a pena revisar quais ferramentas externas via MCP a tarefa daquele momento realmente exige

E tem o nível de esforço (effort), que controla quanto raciocínio o modelo aplica: esforço maior gasta mais tokens

"Mas e o cache?"

Essa é a dúvida clássica, e a resposta é meio contraintuitiva

A partir do segundo turno, o conteúdo repetido é cobrado na tarifa de leitura de cache, que é mais barata

Porém ele CONTINUA ocupando espaço da janela de contexto em toda mensagem

Cache reduz o custo, não reduz o espaço ocupado

Então não conte com ele pra segurar uma sessão inflada

A prevenção mais simples:

O comando /clear limpa a conversa e recomeça do zero mantendo os arquivos do projeto disponíveis

Ele é indicado justamente na troca de tarefa

/clear

Terminou de mexer no login e vai pro layout? Limpa

Arrastar o histórico da tarefa anterior é pagar caro por contexto que não serve mais pra nada

Como ver quanto você já consumiu (antes de ser bloqueado)

Dá pra acompanhar o consumo em vez de descobrir no susto

São caminhos diferentes, e cada um serve pra uma coisa

  1. Abra Settings > Usage nas configurações da sua conta Claude

Nas contas Pro, Max, Team e Enterprise por assento, essa seção mostra barras de progresso do limite de sessão de 5 horas e dos limites semanais

É a visão mais completa, porque você vê as duas camadas lado a lado

  1. Dentro do Claude Code, rode /usage pra ver o uso atual
/usage

Esse é o comando pra consultar sem sair do terminal, no meio do trabalho

  1. Use /cost se você autentica por chave de API
/cost

Ele mostra o gasto corrente da sessão nesse tipo de autenticação

  1. Rode /usage-credits depois de entrar com a assinatura
/login
/usage-credits

O erro comum deste passo: procurar o /usage-credits estando autenticado por chave de API

Ele só fica disponível depois de entrar com a assinatura via /login e não funciona na autenticação por chave de API

Se ele não aparece pra você, é bem provável que seja isso, e não um problema na instalação

Bati no limite: o que a mensagem quer dizer e o que fazer

A mensagem que aparece ao bater no teto MUDA conforme os créditos de uso estejam ligados ou não

E as duas são bem diferentes na prática

Sem créditos de uso:

5-hour limit reached - resets [horário]

Aqui o trabalho para de verdade até o horário indicado

É o bloqueio clássico, aquele que pega você no meio da tarefa

Com créditos de uso ligados:

5-hour limit resets [horário] - continuing with usage credits

Repara na diferença: essa segunda mensagem AVISA o horário do reset, mas a sessão segue rodando

E o que são esses créditos de uso?

Eles estão disponíveis para Pro, Max 5x e Max 20x, e permitem continuar trabalhando depois de estourar o limite incluso, passando a pagar por consumo nas tarifas padrão de API

Valem tanto para o Claude quanto para o Claude Code no terminal

Tem um detalhe prático bom: nos planos Pro e Max, ao atingir o limite de gasto com créditos ainda disponíveis, o próprio Claude Code oferece aumentar ou remover esse limite sem você sair da CLI

Ou seja, a decisão de continuar pagando por consumo acontece ali mesmo, no fluxo

Tome cuidado com isso, beleza? Continuar rodando é ótimo pro prazo, mas é bom saber que a partir dali a conta muda de natureza

O que aconteceu quando reduzi o que entra na conversa

Se o histórico acumulado é o principal vetor de consumo, a conclusão prática é direta: quanto menos texto entra na conversa, mais a sessão dura

E tem um lugar onde entra MUITO texto sem ninguém perceber: a saída dos comandos que a IA roda no terminal por conta própria

Você pede uma tarefa qualquer e ela dispara verificações sozinha, e cada saída dessas volta pro contexto

Pra medir esse efeito eu gravei um teste pro vídeo do canal: mesmo projeto, mesmo prompt, rodado duas vezes, sendo a segunda rodada com uma ferramenta gratuita ligada, que enxuga essa saída de comandos antes dela entrar no contexto

Instalação e configuração dela eu não vou detalhar aqui, porque é justamente o assunto do vídeo, onde dá pra ver tudo na tela

O prompt foi propositalmente pesado em comandos: contar arquivos, listar dependências, checar testes, rodar instalação e build, verificar o estado do versionamento

O que deu, na minha máquina:

  • rodada sem a ferramenta: cerca de 2 minutos e pouco
  • mesma rodada com a ferramenta ligada: cerca de 1 minuto
  • comando que mais economizou no relatório (a listagem de arquivos): 75% de tokens economizados
  • economia total daquela sessão de teste, segundo o relatório da ferramenta: 33%

E olha, preciso ser honesto: foi um cenário rígido e artificial, sem funcionalidade real sendo construída

No uso diário, com comandos mais pesados e projeto em andamento, a tendência é a economia ser maior

Mas o mecanismo é exatamente o que a gente já explicou lá em cima: menos texto reenviado por mensagem, menos consumo por turno

No vídeo abaixo eu mostro a rodada comparada na tela, com os comandos disparando em sequência e o relatório no fim

Rotinas que fazem a sessão render mais

Nada de fórmula mágica aqui, é só traduzir o mecanismo em hábito

  • /clear ao trocar de tarefa: em vez de arrastar o histórico da tarefa anterior por mais 40 mensagens, zera a conversa (os arquivos do projeto continuam disponíveis)
  • Só as ferramentas e conectores que a tarefa exige: eles estão no contexto o tempo todo, então cada extra ligado é imposto fixo
  • Calibrar o nível de esforço pela dificuldade real: esforço alto é ótimo pra problema cabeludo, é desperdício pra ajuste bobo
  • Prompt mais fechado desde o começo: pedido vago gera ida e volta, e ida e volta é histórico acumulado (vale revisar suas técnicas de prompt no Claude Code)
  • Rodar /usage antes de abrir uma frente longa: descobrir que sobrou pouco ANTES de começar o refactor é bem melhor que descobrir no meio
  • Lembrar que chat e IDE bebem do mesmo saldo: se você passou a manhã no Claude, o terminal já começa a tarde com menos margem

Resumo e o que fazer agora

Recapitulando o essencial

São dois limites empilhados: a janela contínua de 5 horas, que começa na sua primeira mensagem e reinicia sozinha, e o limite semanal dos planos pagos, com reset em dia e horário fixos da sua conta (e nos planos Max, dois tetos semanais separados, um geral e um de Sonnet)

O principal vetor de consumo é o histórico acumulado, reenviado a cada nova mensagem

E o consumo é compartilhado entre Claude, Claude Code e as IDEs suportadas

O próximo passo é bem simples: na sua próxima sessão, roda /usage antes de começar e usa /clear toda vez que virar de tarefa

Só com esses dois hábitos você já para de ser surpreendido pelo bloqueio no pior momento possível

até o próximo post! 😀

Perguntas frequentes

Quando o limite de 5 horas do Claude Code reinicia?

A janela de 5 horas é contínua e começa a contar a partir da primeira mensagem que você envia na sessão, não em horário fixo do relógio. Ela reinicia sozinha ao fim dessas 5 horas, sem precisar de nenhuma ação sua.

O limite do Claude Code no plano Max é igual ao do Pro?

Não. O Max 5x entrega 5x o uso do Pro por sessão e o Max 20x entrega 20x. Além disso, os planos Max têm dois limites semanais separados: um geral, para todos os modelos, e outro específico para modelos Sonnet.

Usar o Claude pelo navegador consome o mesmo limite do Claude Code?

Sim. Os limites são únicos e somam o uso no Claude, no Claude Code e nas IDEs suportadas (VS Code, forks do VS Code e IDEs JetBrains). Uma conversa longa no chat pode reduzir o saldo disponível pro terminal no mesmo dia.

Dá pra continuar usando o Claude Code depois de bater no limite?

Depende do plano e dos créditos de uso. Assinantes de Pro, Max 5x e Max 20x podem seguir trabalhando após estourar o limite incluso, pagando por consumo na tarifa padrão de API, tanto no Claude quanto no Claude Code no terminal. Nos planos Pro e Max, ao atingir o limite de gasto com créditos ainda disponíveis, o próprio Claude Code oferece aumentar ou remover esse limite sem sair da CLI.

Por que o /usage-credits não aparece no meu Claude Code?

Esse comando só fica disponível depois de entrar com a assinatura via /login, e não funciona na autenticação por chave de API. Se você autentica por chave de API, o caminho certo pra acompanhar o gasto é o /cost.

O comando /clear devolve o limite já consumido no Claude Code?

Não devolve cota gasta, mas evita que ela suba à toa dali pra frente. O /clear limpa o histórico da conversa e recomeça do zero mantendo os arquivos do projeto disponíveis, o que ajuda porque o histórico acumulado é reenviado a cada mensagem e é o principal vetor de consumo dentro de uma sessão.




Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares