Kimi K3 é grátis? Até onde vai o plano gratuito, quando ele trava e o que fazer ao bater o limite

indicador de uso do Kimi K3 grátis batendo no limite de créditos no app
Resposta rápida

Kimi K3 grátis existe pela metade: a Kimi tem um plano gratuito nomeado, o Adagio, que custa US$ 0, mas o K3 é cobrado em créditos, enquanto o K2.6 no chat não consome crédito de membership. A Moonshot não publica cota fixa do gratuito, então a única referência confiável é o indicador de uso dentro do app. Bateu o limite, as saídas são esperar o reset mensal, trocar de modelo no dropdown, ativar Extra Usage, subir pro Moderato (US$ 19 por mês) ou pagar por token na API. Chave ou endpoint gratuito do K3 não existe

Grátis existe, ilimitado é outra história

Fala aí, beleza? A Kimi tem sim um plano gratuito com nome e tudo: ele se chama Adagio e custa US$ 0, listado na mesma tabela oficial de assinaturas onde moram os tiers pagos

Só que "tem plano grátis" e "tem K3 de graça sem fim" são coisas bem diferentes, e é aí que a maioria se enrola

Neste post eu vou te mostrar onde o gratuito realmente acaba, como identificar o bloqueio quando ele chega (spoiler: o erro 429 tem mais de uma causa) e quais são as saídas reais, da mais barata pra mais cara

O que dá pra fazer no plano gratuito da Kimi (e o que não dá)

A documentação da Kimi separa bem as duas coisas dentro do chat:

  • K2.6 no chat: não consome créditos de membership
  • K3 (inclusive o K3 em modo multiagente): é cobrado por créditos

Então, quando tu conversa no K2.6, o medidor não corre

Quando tu chama o K3, corre

Como o crédito é consumido:

O que consome membership divide um pool único de créditos, e esse pool é medido por uso de tokens (o K2.6 no chat, como eu falei ali em cima, é justamente a exceção que fica fora dessa conta)

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 114 aulas
  • 4 projetos
  • 9h 18min

O consumo é proporcional ao volume de tokens da tarefa, entrada + saída somadas

Que diferença isso faz na prática? Faz TODA

Uma pergunta curta custa pouco, e uma tarefa longa, do tipo mandar a IA criar um jogo com IA do zero, com dezenas de idas e voltas e arquivos inteiros no contexto, come o pool muito rápido

Tiers mais altos recebem um pool proporcionalmente maior, mas a lógica de consumo é a mesma pra todo mundo

A alavanca prática de economia:

Dentro do chat em kimi.com existe um dropdown de modelo, e é por ele que tu escolhe qual modelo roda a conversa

Esse seletor é a alavanca mais barata que existe: tarefa pesada de raciocínio tu manda pro modelo que faz sentido, papo comum tu deixa no K2.6, que não puxa crédito de membership

E quantos tokens grátis eu tenho, afinal?

Aqui vem a parte que ninguém gosta de ouvir: a Moonshot não divulga uma cota fixa de tokens ou mensagens pro plano gratuito

E esse número pode mudar a qualquer momento, sem aviso

Por isso eu não vou botar número nenhum aqui, seria chute

A referência confiável é uma só: o indicador de uso dentro do próprio app

Tome cuidado com post que te promete "X mensagens grátis por dia" com número redondo, isso costuma ser achismo copiado de outro post 🙂

Quando o Kimi K3 trava: como ler o erro 429 antes de concluir qualquer coisa

O sintoma é sempre parecido: a requisição é recusada, a tarefa para no meio, e bate aquela sensação de que "o modelo caiu de qualidade"

Na maioria das vezes não caiu qualidade nenhuma, tu bateu numa parede administrativa

As quatro causas do mesmo 429:

A documentação de erros da API da Kimi é clara: o 429 pode ser

  • sobrecarga do motor de inferência
  • limite de taxa da conta
  • saldo insuficiente
  • limite mensal de uso do ciclo atingido

Quatro origens, um código só

Por isso a regra é ler o campo error.type ANTES de concluir qualquer coisa

Sem isso tu tá adivinhando

O que fazer em cada caso:

Sobrecarga do motor e limite de taxa são transitórios, eles passam

Cota esgotada e saldo insuficiente são outra história: nesses dois casos não existe retry automático, a chamada falha na hora e só volta a funcionar depois de recarga, renovação ou reset do ciclo

É exatamente aqui que o pessoal se ferra: fica reenviando a mesma requisição achando que é instabilidade, e não é

Como prevenir:

Acompanhar o consumo antes de disparar tarefa longa já resolve metade

E se tu usa o Kimi Code, existe um comando pra isso:

/usage

Ele mostra a cota atual e o status da membership

Detalhe importante: esse comando é do Kimi Code, não do chat web, então não adianta digitar ele na caixa do kimi.com e esperar mágica

Bateu o limite: o que fazer, na ordem

Da saída mais barata pra mais cara, na ordem que eu faria:

  1. Esperar o reset mensal do saldo de créditos

Os créditos de membership são renovados mensalmente, tanto pra quem paga mensal quanto pra quem paga anual

Quando a cota total é esgotada, novas requisições param até o reset do ciclo seguinte ou até upgrade de plano

O erro comum deste passo: confundir bloqueio de cota com instabilidade e ficar reenviando

Como não existe retry automático nesse caso, tu só gasta tempo e nervo

  1. Trocar o modelo no dropdown do chat pro K2.6

O K2.6 no chat não consome créditos de membership, então o papo continua enquanto o saldo não volta

O erro comum deste passo: esquecer que trocou

Se tu volta pra uma tarefa pesada dias depois sem olhar o seletor, o modelo que tá carregado é o que tu deixou lá

  1. Ativar o Extra Usage

Com o Extra Usage ativo, ao bater a cota o consumo migra pra um saldo separado, sem interromper a tarefa

E a renovação da cota da membership não é afetada por isso

É a rede de segurança pra quem não pode ter a tarefa morrendo no meio

O erro comum deste passo: ligar e esquecer

Como o consumo passa a sair de outro saldo, ele não some, ele só muda de bolso

  1. Subir de plano

O primeiro degrau pago acima do gratuito é o Moderato: US$ 19 por mês, ou US$ 180 por ano na cobrança anual

O erro comum deste passo: assinar sem olhar o aviso de ajuste de planos que a Moonshot publicou em 20/07/2026, que eu abro inteirinho na seção "Os planos vão mudar: o que já se sabe", mais pra frente aqui no post

  1. Sair da assinatura e ir pra cobrança por token via API

Se teu uso é irregular, pagar por token pode fazer mais sentido que assinar

A tabela da próxima seção mostra as faixas

O erro comum deste passo: achar que existe uma versão gratuita da API pra testar antes

Não existe

Assinatura, API ou OpenRouter: quanto custa cada rota

Antes da tabela, um recado de honestidade: aqui embaixo estão só as rotas com preço confirmado em fonte oficial

Rota Custo O que entrega
Adagio (gratuito) US$ 0 plano gratuito nomeado na tabela oficial de membership; o K3 é cobrado em créditos, o K2.6 no chat não
Moderato US$ 19 por mês, ou US$ 180 por ano primeiro degrau pago acima do gratuito
API da Moonshot US$ 3,00 por 1M de tokens de entrada em cache miss, US$ 0,30 por 1M em cache hit, US$ 15,00 por 1M de saída endpoint https://api.moonshot.ai/v1, model ID kimi-k3, pay as you go único, sem tiering por comprimento de contexto
OpenRouter mesmas faixas de US$ 3 e US$ 15 por 1M K3 por token sem exigir assinatura da Kimi, contexto de 1M, entrada de texto e imagem, tool calls e saída estruturada

E os planos Allegro, Vivace e Allegretto, que aparecem logo ali na seção de contexto longo? Eles existem e importam, mas eu não tenho o preço deles verificado pra citar, então não vou botar número aqui

Chute de preço é exatamente o tipo de coisa que envelhece mal em duas semanas, prefiro te mandar conferir o valor na tabela oficial de membership da Kimi na hora de assinar

Repara no desconto de cache: entrada em cache hit sai por US$ 0,30 por 1M contra US$ 3,00 em cache miss

Quem reaproveita bem o mesmo contexto paga bem menos, e isso muda a conta inteira num fluxo de código

E o ponto que fecha a discussão do "grátis": não existe endpoint gratuito nem chave de API gratuita pro Kimi K3

Sem variante :free, sem provedor gratuito confiável

Se alguém te oferecer uma, desconfia

Contexto longo: onde o limite não é crédito, é plano

Existe uma segunda parede que o usuário também sente como "caiu de qualidade", e ela não tem nada a ver com crédito

É o teto de contexto

E aqui a regra muda conforme o PRODUTO, se liga nisso porque é onde mais gente se perde

No chat da Kimi:

A capacidade de conversa extra longa, até 1 milhão de tokens de contexto, é liberada apenas nos planos Allegro e Vivace

No Kimi Code:

Produto diferente, régua diferente

Lá o k3 vai até 256K de contexto no plano Moderato, e até 1M a partir do Allegretto

Existe também um identificador k3-256k, com limite fixo de 256K

Ou seja: instrução de um produto não vale pro outro

O que tu leu sobre o chat não descreve o Kimi Code, e vice versa

Já vi gente jurando que "o K3 tem 1M de contexto" e brigando com a ferramenta porque na conta dela o teto era outro

Rodar o Kimi K3 local sai mais barato? Faz a conta antes

Agora a tentação final: se o modelo é de pesos abertos, é só baixar e rodar em casa de graça, né?

Será?

Os pesos estão publicados mesmo, no repositório oficial da Moonshot: huggingface.co/moonshotai/Kimi-K3, com shards safetensors, LICENSE e model card, publicados em 27/07/2026

Até aí, lindo

Agora a conta:

  • 2,8 trilhões de parâmetros
  • contexto de 1M de tokens
  • visão nativa
  • cerca de 594 GB em BF16
  • mínimo citado de 4 a 8 GPUs H100 de 80 GB, e olha que isso é pra uso EXPERIMENTAL

Não é PC da Nasa, é datacenter mesmo haha

A conclusão honesta é chata mas é essa: aberto não significa acessível

Auto hospedagem do K3 está fora do alcance de um desenvolvedor individual, e quem promete o contrário tá vendendo alguma coisa

Os planos vão mudar: o que já se sabe

Lembra do aviso que eu citei lá no passo de subir de plano? Chegou a hora dele

Em 20/07/2026 a Moonshot publicou um aviso de ajuste nos planos de assinatura, e vale ler antes de tu decidir qualquer coisa

O que o aviso diz:

  • os planos revisados ainda NÃO estão à venda, por restrição de capacidade
  • não há data confirmada
  • os benefícios de quem já paga seguem inalterados
  • os planos antigos continuam válidos e renováveis
  • a intenção declarada é separar os benefícios de Kimi e de Kimi Code, pra compra independente

O que isso significa na prática pra quem vai assinar agora: tu não fica preso num plano que vai virar pó, os antigos seguem renováveis

Mas se o teu interesse é SÓ o Kimi Code, a separação anunciada pode mudar a conta lá na frente

Sobre preço futuro eu não vou especular, porque não tem número publicado e chutar isso é o tipo de coisa que envelhece mal em duas semanas

Conclusão

Dá pra usar a Kimi sem pagar, isso é verdade: o Adagio existe, custa US$ 0 e está lá na tabela oficial

O problema é que o K3 é justamente a parte cara do pacote, ele é cobrado em créditos enquanto o K2.6 no chat não consome nada, e o gratuito não tem cota divulgada

Sem número publicado, quem depende do K3 pra trabalhar precisa de plano B, ponto

O próximo passo concreto é curtinho:

  1. checa o indicador de uso no app (ou roda /usage se tu tá no Kimi Code)
  2. decide entre trocar de modelo no dropdown, ativar o Extra Usage ou ir pra cobrança por token
  3. antes de reenviar qualquer requisição recusada, lê o error.type do 429, porque cota esgotada não volta com insistência

E se a tua dúvida agora é o que esse modelo entrega no dia a dia de código, o caminho é o post sobre o K3 no vibe coding, com os casos de uso reais no fluxo de desenvolvimento

Até o próximo post! 😀

Perguntas frequentes

Dá pra rodar o Kimi K3 de graça, localmente, sem pagar nada de assinatura ou API?

Na teoria sim, porque o K3 é um modelo de pesos abertos publicado no Hugging Face, no repositório oficial da Moonshot. Na prática não, porque ele tem 2,8 trilhões de parâmetros, pesa cerca de 594 GB em BF16 e o mínimo citado pra uso experimental é de 4 a 8 GPUs H100 de 80 GB. Isso deixa a auto hospedagem fora do alcance de qualquer desenvolvedor individual.

Existe alguma chave de API gratuita pro Kimi K3?

Não existe. Não há variante gratuita nem provedor confiável de API do K3 sem custo, nem na Moonshot nem no OpenRouter. Quem procura Kimi K3 grátis pela via de API vai esbarrar direto na cobrança por token.

Qual a diferença prática entre o plano Adagio e o Moderato?

Adagio é o plano gratuito, custa US$ 0 e aparece na tabela oficial de membership junto dos tiers pagos. Moderato é o primeiro degrau pago acima dele, US$ 19 por mês ou US$ 180 por ano na cobrança anual. A diferença de fundo é o tamanho do pool de créditos, já que planos mais altos recebem um pool proporcionalmente maior pro mesmo consumo por token.

O Extra Usage cobra sozinho quando a cota acaba, ou eu preciso ativar antes?

É um recurso que existe pra continuar a tarefa quando qualquer cota é atingida. Com ele ativo, ao bater o limite o consumo migra pra um saldo separado, sem interromper o que tu tá fazendo. E a renovação da cota normal da membership não é afetada por esse desvio.

Vale a pena assinar antes do reajuste de planos que a Moonshot anunciou?

A Moonshot avisou em 2026-07-20 que os planos revisados ainda não entraram em vigor, sem data confirmada, por restrição de capacidade. Quem já é assinante mantém os benefícios atuais, e os planos antigos continuam válidos e renováveis normalmente. A intenção declarada é separar benefícios de Kimi e de Kimi Code pra compra independente, mas isso ainda não vale hoje.

Dá pra usar o Kimi K3 pelo OpenRouter sem assinar nada da Kimi?

Dá sim, o OpenRouter oferece o K3 com cobrança por token, sem exigir assinatura da Kimi. O pacote inclui contexto de 1M de tokens, entrada de texto e imagem, tool calls e saída estruturada, nas mesmas faixas de US$ 3 por 1M de entrada e US$ 15 por 1M de saída da API oficial. É uma rota separada da assinatura Adagio ou Moderato, pensada pra quem quer pagar só pelo uso.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares