Claude Code ou DeepSeek: como funciona a cobrança de cada um?

Claude Code ou DeepSeek não é uma disputa de preço, é uma disputa de modelo de cobrança. O Claude Code não tem preço avulso: vem incluído nos planos pagos do Claude (Pro a US$ 20/mês, Max 5x a US$ 100 e Max 20x a US$ 200) ou roda por API, cobrada por token (Opus 4.5 US$ 5/US$ 25 por milhão, Sonnet 5 US$ 2/US$ 10, Haiku 4.5 US$ 1/US$ 5). O DeepSeek só cobra consumo: por milhão de tokens, com tarifa de pico e fora de pico. Um vira teto de uso, o outro vira conta variável
Fala aí, beleza? Um cobra pelo acesso à ferramenta, o outro cobra pelo que o modelo processa
Parece detalhe, mas é a diferença que decide tudo antes de qualquer comparação de preço
Quem pergunta Claude Code ou DeepSeek quase sempre quer saber qual sai mais barato
Só que essa pergunta não tem resposta limpa no geral, porque os dois não cobram pela mesma coisa
Na assinatura você paga um valor fixo e recebe um teto de uso
Na API você não paga nada por mês e a conta sobe conforme os tokens que passam pelo modelo
Então o que dá pra fazer de verdade é prever DE ONDE vem a sua conta em cada caminho, e é isso que eu quero destrinchar aqui 🙂
Como funciona a cobrança do Claude Code
Primeiro detalhe que confunde muita gente: o Claude Code não tem preço avulso
Ele não é um SKU separado, vem incluído nos planos pagos do Claude (Pro, Max, Team e Enterprise) ou roda sobre uma conta de API pay-as-you-go que você já tenha
O plano Free não dá acesso ao Claude Code, então não existe entrada gratuita por esse lado
O mais barato com acesso é o Pro, a US$ 20 por mês nos Estados Unidos
Acima dele ficam os dois níveis de Max: US$ 100 por mês no Max 5x e US$ 200 por mês no Max 20x
E se liga nisso: os dois níveis do Max entregam os mesmos modelos e os mesmos recursos, o que muda entre eles é só a quantidade de uso liberada
Tem também um detalhe de fatura que pega: o Max é oferecido apenas em assinatura mensal, sem opção anual. O Pro aceita mensal ou anual
A cota é uma só pra tudo:
Esse é o ponto que mais estraga previsão de custo
Na assinatura, o consumo do Claude Code e o do chat saem do mesmo bolso
Todas as superfícies do Claude dividem a mesma cota: claude.ai, Claude Code e Claude Desktop contam pro mesmo limite, e o uso do Claude Code dentro das IDEs suportadas entra na mesma conta
Ou seja, aquela tarde inteira conversando no chat não é "de graça", ela mordeu o mesmo teto que o agente ia usar depois
Domine o Claude Code do básico ao avançado
Você vai aprender a criar sistemas completos com Claude Code, sem precisar ser programador. Inscreva-se para ter acesso a um desconto de lançamento e bônus especiais!
Não é um saldo, são dois relógios:
Outro ponto que muda o jeito de planejar
A cota da assinatura não funciona como um saldo único que vai descendo até zerar no fim do mês
São dois controles rodando ao mesmo tempo:
- um limite de sessão que reinicia a cada cinco horas
- um limite semanal, que vale pra todos os modelos e reinicia num horário fixo atribuído à sua conta
Dá pra estourar o limite de sessão numa manhã intensa e voltar a trabalhar no mesmo dia, e dá pra estar tranquilo na sessão e ainda assim bater o teto da semana
Onde ver quanto você já gastou:
Quem assina consegue acompanhar isso sem adivinhação
Em Settings > Usage, nas configurações da conta Claude (planos Pro, Max, Team e Enterprise por assento), aparecem as barras de progresso da sessão de cinco horas e do limite semanal, junto com o horário do próximo reset
É o primeiro lugar que eu olharia antes de decidir trocar de caminho, porque ali você vê se o problema é ritmo de sessão ou volume da semana
E quando estoura?
Esperar o reset é a saída óbvia, mas não é a única
Dá também pra subir de plano ou comprar créditos de uso (os usage credits, disponíveis pros planos pagos)
Se o seu caso for o contrário, e a conclusão for que o plano está grande demais pro seu uso, eu já escrevi sobre baixar ou cancelar o plano do Claude e o que some na hora
O caminho de API: pagar o Claude Code por token
Aqui a lógica vira do avesso
No caminho de API da Anthropic não existe mensalidade nem teto de sessão: você paga por token, com preço diferente por modelo
Os valores são por milhão de tokens, entrada e saída cobradas separado:
| Modelo | Entrada (US$ por 1M tokens) | Saída (US$ por 1M tokens) |
|---|---|---|
| Claude Opus 4.5 | 5 | 25 |
| Claude Sonnet 5 | 2 | 10 |
| Claude Haiku 4.5 | 1 | 5 |
Repara na distância entre entrada e saída: token que o modelo ESCREVE custa cinco vezes o token que ele lê, nos três casos
Por isso agente que fica reescrevendo arquivo inteiro dói mais na fatura do que agente que lê muito e edita pouco
E teve uma boa notícia recente aqui: o preço de US$ 2 / US$ 10 do Sonnet 5, que tinha sido anunciado como introdutório até 31/08/2026, virou o preço padrão
O reajuste que estava marcado pra US$ 3 / US$ 15 em 01/09/2026 não vai acontecer
E se a conta precisar ir pra outro lugar?
Essa parte interessa mais a quem tem empresa no meio
O Claude Code suporta Amazon Bedrock, Google Vertex AI e proxies corporativos que respeitem a especificação da API da Anthropic
Nesses casos o agente é o mesmo, mas a cobrança vai pro provedor escolhido, não pra Anthropic
Pra quem já tem contrato de nuvem fechado, isso costuma valer mais que qualquer comparação de tabela
Como funciona a cobrança do DeepSeek
Do lado do DeepSeek não existe assinatura de ferramenta pra comparar
Não tem plano, não tem mensalidade, não tem teto semanal: a API cobra por total de tokens consumidos, somando entrada e saída, com preço expresso por 1 milhão de tokens
A versão GA do DeepSeek-V4-Pro foi liberada em 13/08/2026 no app, na web e na API, e junto com ela veio uma mudança na estrutura de preços que entrou em vigor às 16:00 UTC de 16/08/2026
Esse modelo trabalha com janela de contexto de 1 milhão de tokens (arquitetura com 1,6T de parâmetros totais e 49B ativos), o que importa pra conta porque contexto grande é justamente token de entrada rodando de novo a cada volta
Preço que muda conforme a hora do dia:
Essa é a novidade que muda o jeito de prever gasto
O DeepSeek passou a ter tarifa de pico e tarifa fora de pico
O horário de pico é das 01:00 às 04:00 e das 06:00 às 10:00 (UTC). Todas as demais horas são fora de pico, e a tarifa fora de pico é 50% da tarifa de pico
A tabela do V4-Pro por 1 milhão de tokens ficou assim:
| Faixa | Fora de pico (US$) | Pico (US$) |
|---|---|---|
| Entrada com cache hit | 0,022 | 0,044 |
| Entrada com cache miss | 0,66 | 1,32 |
| Saída | 1,98 | 3,96 |
O cache é o que mais mexe na sua conta:
Olha de novo pra primeira linha da tabela e compara com a segunda
A API separa prompt_cache_hit_tokens de prompt_cache_miss_tokens e cobra cada faixa com preço próprio
Fora de pico, o token que veio do cache sai a US$ 0,022 contra US$ 0,66 do token novo
É token repetido custando uma fração do token inédito, e num agente de terminal quase todo prompt carrega contexto repetido: as mesmas instruções, os mesmos arquivos, o mesmo histórico
Por isso duas pessoas podem rodar o mesmo modelo, no mesmo horário, e ter contas bem diferentes no fim do dia
A tarifa fora de pico do DeepSeek não é desconto: é aumento
Aqui é onde a leitura fácil engana
Bateu o olho em "metade do preço fora de pico" e a cabeça já entende promoção, né? Só que não é isso que aconteceu
A mudança de agosto foi um REAJUSTE, que chega a mais de 1.100% em algumas faixas da família V4 segundo a apuração do InfoWorld
A tarifa fora de pico é metade de um pico que subiu, e ainda assim fica acima da tarifa fixa que valia antes
Ou seja: "fora de pico" aqui não significa mais barato que ontem, significa menos caro que agora às 08:00 UTC
Por que subiu?
O motivo declarado foi demanda acima da capacidade
A empresa passou a incentivar agendamento mais flexível de workloads, cobrando tarifa cheia no pico e metade fora dele, e as reportagens citam o volume do V4-Flash pressionando a capacidade disponível
É preço sendo usado como fila, basicamente: quem pode esperar, paga menos
O outro botão que mexe na conta:
Tem ainda uma alavanca do lado do modelo
Os modos de raciocínio do V4-Pro e do V4-Flash passaram a ter níveis de thinking effort selecionáveis: low, high e max, escolhidos conforme a complexidade da tarefa
Como raciocínio vira token de saída, e saída é a faixa mais cara das três, deixar tudo no máximo por padrão é o jeito mais rápido de inflar a fatura sem perceber
E vale registrar uma mudança que facilita a vida de quem usa agente de terminal: a API do DeepSeek passou a suportar nativamente o formato Responses da OpenAI, com adaptação específica e configuração de um clique pro Codex, e a documentação lista páginas de integração pra Codex, Pi e Oh My Pi
Repara no que NÃO aparece nessa lista: o Claude Code. Não existe integração documentada entre os dois lados, então tudo que envolver essa combinação é experimento, não caminho oficial
Claude Code x DeepSeek: comparativo dos modelos de cobrança
Colocando lado a lado, com os três caminhos possíveis:
| Critério | Claude Code na assinatura | Claude Code por API | DeepSeek por API |
|---|---|---|---|
| Formato de cobrança | Valor fixo mensal do plano Claude | Pay-as-you-go por token | Pay-as-you-go por token |
| Preço de entrada | Pro US$ 20/mês, Max 5x US$ 100, Max 20x US$ 200 | Sem mensalidade, paga o que usar | Sem mensalidade, paga o que usar |
| O que dispara a conta | Qualquer uso do Claude, em qualquer superfície | Tokens de entrada e de saída por modelo | Total de tokens de entrada e de saída |
| Unidade de medida | Cota de uso do plano | US$ por milhão de tokens | US$ por milhão de tokens |
| Teto ou limite | Sessão de 5h mais limite semanal com reset fixo | Sem teto de uso publicado | Sem teto de uso publicado |
| Onde acompanhar | Settings > Usage, com barras e horário do reset | Painel da conta de API | Painel de uso da conta de API |
| Varia por horário? | Não | Não | Sim: pico e fora de pico (metade) |
| Efeito de cache | Não muda o valor do plano | Cobrança por modelo em entrada e saída | Cache hit a US$ 0,022 contra US$ 0,66 do cache miss (fora de pico) |
| Faturamento alternativo | Não se aplica | Amazon Bedrock, Google Vertex AI ou proxy corporativo | Não se aplica |
| Ao estourar | Esperar reset, subir de plano ou comprar créditos de uso | A conta simplesmente continua subindo | A conta simplesmente continua subindo |
Repara que a linha mais importante da tabela não é a de preço, é a de "o que dispara a conta"
Num lado você compra teto, no outro você compra consumo
O que aconteceu quando rodei o Claude Code com o DeepSeek
Agora sai da teoria
No vídeo abaixo eu deixo o painel de uso do DeepSeek aberto o tempo todo, justamente pra ver o número subindo em tempo real enquanto o projeto nasce
Antes de qualquer coisa, uma correção de expectativa: nesse caminho o DeepSeek não é de graça
É preciso entrar na plataforma, criar uma chave de API e colocar crédito antes de começar. Existe a variação open source pra rodar local, mas aí você precisa de um PC da Nasa, então na prática a API é o caminho viável
E não vou fingir que tenho passo a passo oficial pra te entregar aqui: como eu falei lá em cima, a documentação do DeepSeek lista integração com Codex, Pi e Oh My Pi, e o Claude Code não está nessa lista. O que vem abaixo é relato do que aconteceu no meu teste, não tutorial de configuração suportada
Eu coloquei 2 dólares de crédito e fui pro teste
Deixei o Pro como modelo padrão no lugar do Opus e o Flash pras tarefas mais simples e pros subagents, que é onde mora a jogada de economia
O projeto foi um SaaS de geração de slogans, com landing page, registro, login, dashboard, banco de dados e integração com IA. Nada sofisticado, mas com o fluxo de criar conta, logar e gerar slogan funcionando de ponta a ponta
Uma execução de teste anterior já tinha aparecido no painel por 3 centavos de dólar
O projeto completo fechou em torno de 11 a 12 centavos de dólar
E aqui vai a ressalva honesta: parte desse consumo fica mascarada, porque a própria aplicação que eu criei usa a MESMA chave de API do DeepSeek nos testes dela. Então tem token de teste da app misturado com token do agente
Uma coisa que me surpreendeu: o modelo do DeepSeek usa as tools normalmente dentro do Claude Code, mesmo sendo de uma empresa diferente da que criou o agente
Isso não é benchmark, beleza? É ordem de grandeza de UM projeto, do MEU jeito de pedir as coisas. Se você trabalha em repositório grande, com contexto pesado indo e voltando, o número muda
Se você quer ver o outro extremo dessa conta, eu já detalhei o fluxo do primeiro projeto até o deploy rodando o Claude Code pelo caminho tradicional
Qual modelo de cobrança faz mais sentido para o seu uso
Não dá pra responder isso no geral, mas dá pra responder por cenário
Você abre o agente todo dia e quer saber quanto vai pagar antes do mês começar: a assinatura resolve exatamente isso. Você troca imprevisibilidade por teto, e o custo do dia caótico é o mesmo do dia parado. O risco aqui não é a fatura, é bater o limite de sessão ou o semanal no meio de uma entrega
Você usa por projeto, em rajadas, e passa semanas sem abrir: pagar mensalidade pra deixar a cota morrer não faz sentido. Consumo por token cobra zero na semana em que você não usa
Você já tem conta de API montada: o Claude Code roda sobre ela, sem precisar de plano. Só lembra que aí some o teto: nada te barra no meio do caminho, o contador só continua andando
Você precisa que a nota saia por outro fornecedor: esse é caso de Amazon Bedrock, Google Vertex AI ou proxy corporativo compatível com a API da Anthropic. O agente é o mesmo, a cobrança muda de endereço
Seu trabalho pesado pode ser agendado: aí o DeepSeek fica interessante de um jeito específico. Carga que dá pra empurrar pra fora das janelas de pico (01:00 às 04:00 e 06:00 às 10:00 UTC) paga metade da tarifa de pico. Se o seu horário de trabalho cai justo dentro do pico e não dá pra mexer nisso, esse benefício não é seu
Seu fluxo repete muito contexto: com cache hit a US$ 0,022 contra US$ 0,66 do miss no V4-Pro fora de pico, sessão longa e estável no mesmo projeto se comporta bem diferente de vinte sessões novas por dia
Veredito: de onde vem a sua conta em cada caminho
O resumo honesto é esse
A assinatura converte custo em teto de uso. Você sabe o valor da fatura no dia 1, e o que fica incerto é quanto trabalho cabe dentro dela, com dois relógios correndo (sessão de cinco horas e semana) e uma cota que o chat divide com o agente
O consumo converte custo em variável. Você nunca é interrompido por limite de plano, e o que fica incerto é o valor final, que depende de quantidade de tokens, taxa de cache hit, horário da rodada e nível de thinking effort
O que pode dar errado na previsão de cada lado também é diferente
Na assinatura, o erro clássico é esquecer que claude.ai, Claude Desktop e as IDEs suportadas bebem da mesma cota, e aí o limite chega "do nada"
No consumo, o erro clássico é olhar a tarifa fora de pico como se fosse promoção. Não é: o reajuste de agosto foi pra cima, e a metade de um pico elevado ainda fica acima do que se pagava com a tarifa fixa anterior
E tem um ponto que eu prefiro deixar explícito em vez de fingir que resolvi: rodar o DeepSeek dentro do Claude Code não é um caminho documentado oficialmente. A documentação do DeepSeek lista integração com Codex, Pi e Oh My Pi, e a do Claude Code cita Bedrock, Vertex e proxies compatíveis com a API da Anthropic. Funcionou no meu teste, mas não é caminho suportado, e isso é risco que vai no seu bolso, não no meu
Conclusão
A diferença entre os dois nunca foi o preço da etiqueta
Um cobra o acesso à ferramenta e te devolve um teto. O outro cobra o que o modelo processou e te devolve uma conta que muda com token, cache, horário e nível de raciocínio
Próximo passo prático, e é simples: se você já assina, abre Settings > Usage e olha as duas barras antes de decidir qualquer coisa. Se as barras vivem cheias, o problema é volume e trocar de modelo de cobrança pode só mudar o lugar da dor
E se você quer testar o caminho de consumo, faz o que eu fiz: coloca um crédito pequeno, roda UM projeto seu de verdade e mede
Seu fluxo é o único benchmark que vale pra sua fatura…
até o próximo post! 😀
Perguntas frequentes
Quanto custou o projeto que o Matheus rodou no Claude Code com o DeepSeek?
Esse número é de UM teste, não de uma média que sirva pra qualquer pessoa. Foram 2 dólares de crédito colocados na conta da API do DeepSeek, uma execução anterior já tinha aparecido no painel por 3 centavos de dólar e o projeto completo (landing page, registro, login, dashboard, banco de dados e integração com IA) fechou em torno de 11 a 12 centavos. Vale a ressalva: não existe integração documentada entre os dois lados, a documentação do DeepSeek lista Codex, Pi e Oh My Pi, parte do consumo tem token de teste da própria aplicação misturado, e em repositório grande, com mais contexto indo e voltando, o valor muda.
Dá para usar o Claude Code de graça?
Não. O plano Free do Claude não dá acesso ao Claude Code, então é preciso pelo menos o plano Pro, a US$ 20 por mês, ou uma conta de API pay-as-you-go da Anthropic. Não existe SKU avulso e gratuito para a ferramenta.
Qual é o horário de pico do DeepSeek?
O pico acontece das 01:00 às 04:00 e das 06:00 às 10:00, no horário UTC. Todas as demais horas do dia são consideradas fora de pico, e nelas a tarifa cai para 50% do valor cobrado no horário de pico.
O que fazer quando o limite semanal do Claude Code acaba no meio do trabalho?
Existem três caminhos: esperar o reset, que acontece num horário fixo atribuído à conta, subir de plano, ou comprar créditos de uso (usage credits) disponíveis para planos pagos. Não é preciso ficar parado até o próximo ciclo se a urgência for grande.
A tarifa fora de pico do DeepSeek é um desconto em relação ao preço antigo?
Não, e esse é o ponto que engana bastante gente. A mudança de agosto foi na verdade um reajuste que chega a mais de 1.100% em algumas faixas do DeepSeek V4, então a tarifa fora de pico é metade de um valor de pico já elevado, e ainda assim fica acima do preço fixo que existia antes.
Compensa mais assinar o Claude Max ou pagar por token na API da Anthropic?
Depende do volume de uso: o Max cobra valor fixo (US$ 100 ou US$ 200 por mês) com teto de sessão e semanal compartilhado entre todas as superfícies do Claude, enquanto a API cobra por milhão de tokens processados, sem mensalidade. Quem usa pouco ou de forma irregular tende a gastar menos na API, e quem usa o Claude Code o dia inteiro tende a caber melhor num plano fixo.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
As diferenças de var, let e const
Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]
Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação
Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação A popularidade da automação de processos com o n8n está em alta, principalmente […]
