Kimi K3 é grátis? Até onde vai o plano gratuito, quando ele trava e o que fazer ao bater o limite

Kimi K3 grátis existe pela metade: a Kimi tem um plano gratuito nomeado, o Adagio, que custa US$ 0, mas o K3 é cobrado em créditos, enquanto o K2.6 no chat não consome crédito de membership. A Moonshot não publica cota fixa do gratuito, então a única referência confiável é o indicador de uso dentro do app. Bateu o limite, as saídas são esperar o reset mensal, trocar de modelo no dropdown, ativar Extra Usage, subir pro Moderato (US$ 19 por mês) ou pagar por token na API. Chave ou endpoint gratuito do K3 não existe
Grátis existe, ilimitado é outra história
Fala aí, beleza? A Kimi tem sim um plano gratuito com nome e tudo: ele se chama Adagio e custa US$ 0, listado na mesma tabela oficial de assinaturas onde moram os tiers pagos
Só que "tem plano grátis" e "tem K3 de graça sem fim" são coisas bem diferentes, e é aí que a maioria se enrola
Neste post eu vou te mostrar onde o gratuito realmente acaba, como identificar o bloqueio quando ele chega (spoiler: o erro 429 tem mais de uma causa) e quais são as saídas reais, da mais barata pra mais cara
O que dá pra fazer no plano gratuito da Kimi (e o que não dá)
A documentação da Kimi separa bem as duas coisas dentro do chat:
- K2.6 no chat: não consome créditos de membership
- K3 (inclusive o K3 em modo multiagente): é cobrado por créditos
Então, quando tu conversa no K2.6, o medidor não corre
Quando tu chama o K3, corre
Como o crédito é consumido:
O que consome membership divide um pool único de créditos, e esse pool é medido por uso de tokens (o K2.6 no chat, como eu falei ali em cima, é justamente a exceção que fica fora dessa conta)
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 120 aulas
- 4 projetos
- 9h 45min
O consumo é proporcional ao volume de tokens da tarefa, entrada + saída somadas
Que diferença isso faz na prática? Faz TODA
Uma pergunta curta custa pouco, e uma tarefa longa, do tipo mandar a IA criar um jogo com IA do zero, com dezenas de idas e voltas e arquivos inteiros no contexto, come o pool muito rápido
Tiers mais altos recebem um pool proporcionalmente maior, mas a lógica de consumo é a mesma pra todo mundo
A alavanca prática de economia:
Dentro do chat em kimi.com existe um dropdown de modelo, e é por ele que tu escolhe qual modelo roda a conversa
Esse seletor é a alavanca mais barata que existe: tarefa pesada de raciocínio tu manda pro modelo que faz sentido, papo comum tu deixa no K2.6, que não puxa crédito de membership
E quantos tokens grátis eu tenho, afinal?
Aqui vem a parte que ninguém gosta de ouvir: a Moonshot não divulga uma cota fixa de tokens ou mensagens pro plano gratuito
E esse número pode mudar a qualquer momento, sem aviso
Por isso eu não vou botar número nenhum aqui, seria chute
A referência confiável é uma só: o indicador de uso dentro do próprio app
Tome cuidado com post que te promete "X mensagens grátis por dia" com número redondo, isso costuma ser achismo copiado de outro post 🙂
Quando o Kimi K3 trava: como ler o erro 429 antes de concluir qualquer coisa
O sintoma é sempre parecido: a requisição é recusada, a tarefa para no meio, e bate aquela sensação de que "o modelo caiu de qualidade"
Na maioria das vezes não caiu qualidade nenhuma, tu bateu numa parede administrativa
As quatro causas do mesmo 429:
A documentação de erros da API da Kimi é clara: o 429 pode ser
- sobrecarga do motor de inferência
- limite de taxa da conta
- saldo insuficiente
- limite mensal de uso do ciclo atingido
Quatro origens, um código só
Por isso a regra é ler o campo error.type ANTES de concluir qualquer coisa
Sem isso tu tá adivinhando
O que fazer em cada caso:
Sobrecarga do motor e limite de taxa são transitórios, eles passam
Cota esgotada e saldo insuficiente são outra história: nesses dois casos não existe retry automático, a chamada falha na hora e só volta a funcionar depois de recarga, renovação ou reset do ciclo
É exatamente aqui que o pessoal se ferra: fica reenviando a mesma requisição achando que é instabilidade, e não é
Como prevenir:
Acompanhar o consumo antes de disparar tarefa longa já resolve metade
E se tu usa o Kimi Code, existe um comando pra isso:
/usage
Ele mostra a cota atual e o status da membership
Detalhe importante: esse comando é do Kimi Code, não do chat web, então não adianta digitar ele na caixa do kimi.com e esperar mágica
Bateu o limite: o que fazer, na ordem
Da saída mais barata pra mais cara, na ordem que eu faria:
- Esperar o reset mensal do saldo de créditos
Os créditos de membership são renovados mensalmente, tanto pra quem paga mensal quanto pra quem paga anual
Quando a cota total é esgotada, novas requisições param até o reset do ciclo seguinte ou até upgrade de plano
O erro comum deste passo: confundir bloqueio de cota com instabilidade e ficar reenviando
Como não existe retry automático nesse caso, tu só gasta tempo e nervo
- Trocar o modelo no dropdown do chat pro K2.6
O K2.6 no chat não consome créditos de membership, então o papo continua enquanto o saldo não volta
O erro comum deste passo: esquecer que trocou
Se tu volta pra uma tarefa pesada dias depois sem olhar o seletor, o modelo que tá carregado é o que tu deixou lá
- Ativar o Extra Usage
Com o Extra Usage ativo, ao bater a cota o consumo migra pra um saldo separado, sem interromper a tarefa
E a renovação da cota da membership não é afetada por isso
É a rede de segurança pra quem não pode ter a tarefa morrendo no meio
O erro comum deste passo: ligar e esquecer
Como o consumo passa a sair de outro saldo, ele não some, ele só muda de bolso
- Subir de plano
O primeiro degrau pago acima do gratuito é o Moderato: US$ 19 por mês, ou US$ 180 por ano na cobrança anual
O erro comum deste passo: assinar sem olhar o aviso de ajuste de planos que a Moonshot publicou em 20/07/2026, que eu abro inteirinho na seção "Os planos vão mudar: o que já se sabe", mais pra frente aqui no post
- Sair da assinatura e ir pra cobrança por token via API
Se teu uso é irregular, pagar por token pode fazer mais sentido que assinar
A tabela da próxima seção mostra as faixas
O erro comum deste passo: achar que existe uma versão gratuita da API pra testar antes
Não existe
Assinatura, API ou OpenRouter: quanto custa cada rota
Antes da tabela, um recado de honestidade: aqui embaixo estão só as rotas com preço confirmado em fonte oficial
| Rota | Custo | O que entrega |
|---|---|---|
| Adagio (gratuito) | US$ 0 | plano gratuito nomeado na tabela oficial de membership; o K3 é cobrado em créditos, o K2.6 no chat não |
| Moderato | US$ 19 por mês, ou US$ 180 por ano | primeiro degrau pago acima do gratuito |
| API da Moonshot | US$ 3,00 por 1M de tokens de entrada em cache miss, US$ 0,30 por 1M em cache hit, US$ 15,00 por 1M de saída | endpoint https://api.moonshot.ai/v1, model ID kimi-k3, pay as you go único, sem tiering por comprimento de contexto |
| OpenRouter | mesmas faixas de US$ 3 e US$ 15 por 1M | K3 por token sem exigir assinatura da Kimi, contexto de 1M, entrada de texto e imagem, tool calls e saída estruturada |
E os planos Allegro, Vivace e Allegretto, que aparecem logo ali na seção de contexto longo? Eles existem e importam, mas eu não tenho o preço deles verificado pra citar, então não vou botar número aqui
Chute de preço é exatamente o tipo de coisa que envelhece mal em duas semanas, prefiro te mandar conferir o valor na tabela oficial de membership da Kimi na hora de assinar
Repara no desconto de cache: entrada em cache hit sai por US$ 0,30 por 1M contra US$ 3,00 em cache miss
Quem reaproveita bem o mesmo contexto paga bem menos, e isso muda a conta inteira num fluxo de código
E o ponto que fecha a discussão do "grátis": não existe endpoint gratuito nem chave de API gratuita pro Kimi K3
Sem variante :free, sem provedor gratuito confiável
Se alguém te oferecer uma, desconfia
Contexto longo: onde o limite não é crédito, é plano
Existe uma segunda parede que o usuário também sente como "caiu de qualidade", e ela não tem nada a ver com crédito
É o teto de contexto
E aqui a regra muda conforme o PRODUTO, se liga nisso porque é onde mais gente se perde
No chat da Kimi:
A capacidade de conversa extra longa, até 1 milhão de tokens de contexto, é liberada apenas nos planos Allegro e Vivace
No Kimi Code:
Produto diferente, régua diferente
Lá o k3 vai até 256K de contexto no plano Moderato, e até 1M a partir do Allegretto
Existe também um identificador k3-256k, com limite fixo de 256K
Ou seja: instrução de um produto não vale pro outro
O que tu leu sobre o chat não descreve o Kimi Code, e vice versa
Já vi gente jurando que "o K3 tem 1M de contexto" e brigando com a ferramenta porque na conta dela o teto era outro
Rodar o Kimi K3 local sai mais barato? Faz a conta antes
Agora a tentação final: se o modelo é de pesos abertos, é só baixar e rodar em casa de graça, né?
Será?
Os pesos estão publicados mesmo, no repositório oficial da Moonshot: huggingface.co/moonshotai/Kimi-K3, com shards safetensors, LICENSE e model card, publicados em 27/07/2026
Até aí, lindo
Agora a conta:
- 2,8 trilhões de parâmetros
- contexto de 1M de tokens
- visão nativa
- cerca de 594 GB em BF16
- mínimo citado de 4 a 8 GPUs H100 de 80 GB, e olha que isso é pra uso EXPERIMENTAL
Não é PC da Nasa, é datacenter mesmo haha
A conclusão honesta é chata mas é essa: aberto não significa acessível
Auto hospedagem do K3 está fora do alcance de um desenvolvedor individual, e quem promete o contrário tá vendendo alguma coisa
Os planos vão mudar: o que já se sabe
Lembra do aviso que eu citei lá no passo de subir de plano? Chegou a hora dele
Em 20/07/2026 a Moonshot publicou um aviso de ajuste nos planos de assinatura, e vale ler antes de tu decidir qualquer coisa
O que o aviso diz:
- os planos revisados ainda NÃO estão à venda, por restrição de capacidade
- não há data confirmada
- os benefícios de quem já paga seguem inalterados
- os planos antigos continuam válidos e renováveis
- a intenção declarada é separar os benefícios de Kimi e de Kimi Code, pra compra independente
O que isso significa na prática pra quem vai assinar agora: tu não fica preso num plano que vai virar pó, os antigos seguem renováveis
Mas se o teu interesse é SÓ o Kimi Code, a separação anunciada pode mudar a conta lá na frente
Sobre preço futuro eu não vou especular, porque não tem número publicado e chutar isso é o tipo de coisa que envelhece mal em duas semanas
Conclusão
Dá pra usar a Kimi sem pagar, isso é verdade: o Adagio existe, custa US$ 0 e está lá na tabela oficial
O problema é que o K3 é justamente a parte cara do pacote, ele é cobrado em créditos enquanto o K2.6 no chat não consome nada, e o gratuito não tem cota divulgada
Sem número publicado, quem depende do K3 pra trabalhar precisa de plano B, ponto
O próximo passo concreto é curtinho:
- checa o indicador de uso no app (ou roda
/usagese tu tá no Kimi Code) - decide entre trocar de modelo no dropdown, ativar o Extra Usage ou ir pra cobrança por token
- antes de reenviar qualquer requisição recusada, lê o
error.typedo 429, porque cota esgotada não volta com insistência
E se a tua dúvida agora é o que esse modelo entrega no dia a dia de código, o caminho é o post sobre o K3 no vibe coding, com os casos de uso reais no fluxo de desenvolvimento
Até o próximo post! 😀
Perguntas frequentes
Dá pra rodar o Kimi K3 de graça, localmente, sem pagar nada de assinatura ou API?
Na teoria sim, porque o K3 é um modelo de pesos abertos publicado no Hugging Face, no repositório oficial da Moonshot. Na prática não, porque ele tem 2,8 trilhões de parâmetros, pesa cerca de 594 GB em BF16 e o mínimo citado pra uso experimental é de 4 a 8 GPUs H100 de 80 GB. Isso deixa a auto hospedagem fora do alcance de qualquer desenvolvedor individual.
Existe alguma chave de API gratuita pro Kimi K3?
Não existe. Não há variante gratuita nem provedor confiável de API do K3 sem custo, nem na Moonshot nem no OpenRouter. Quem procura Kimi K3 grátis pela via de API vai esbarrar direto na cobrança por token.
Qual a diferença prática entre o plano Adagio e o Moderato?
Adagio é o plano gratuito, custa US$ 0 e aparece na tabela oficial de membership junto dos tiers pagos. Moderato é o primeiro degrau pago acima dele, US$ 19 por mês ou US$ 180 por ano na cobrança anual. A diferença de fundo é o tamanho do pool de créditos, já que planos mais altos recebem um pool proporcionalmente maior pro mesmo consumo por token.
O Extra Usage cobra sozinho quando a cota acaba, ou eu preciso ativar antes?
É um recurso que existe pra continuar a tarefa quando qualquer cota é atingida. Com ele ativo, ao bater o limite o consumo migra pra um saldo separado, sem interromper o que tu tá fazendo. E a renovação da cota normal da membership não é afetada por esse desvio.
Vale a pena assinar antes do reajuste de planos que a Moonshot anunciou?
A Moonshot avisou em 2026-07-20 que os planos revisados ainda não entraram em vigor, sem data confirmada, por restrição de capacidade. Quem já é assinante mantém os benefícios atuais, e os planos antigos continuam válidos e renováveis normalmente. A intenção declarada é separar benefícios de Kimi e de Kimi Code pra compra independente, mas isso ainda não vale hoje.
Dá pra usar o Kimi K3 pelo OpenRouter sem assinar nada da Kimi?
Dá sim, o OpenRouter oferece o K3 com cobrança por token, sem exigir assinatura da Kimi. O pacote inclui contexto de 1M de tokens, entrada de texto e imagem, tool calls e saída estruturada, nas mesmas faixas de US$ 3 por 1M de entrada e US$ 15 por 1M de saída da API oficial. É uma rota separada da assinatura Adagio ou Moderato, pensada pra quem quer pagar só pelo uso.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Como usar o Kimi K3: primeiros passos para quem nunca mexeu
Kimi K3 tem acesso gratuito via kimi.com, sem cartão nem fila de espera. Guia passo a passo para criar conta e fazer seu primeiro teste com o novo modelo da Moonshot AI.
O que é o Kimi K3 e para que serve?
Kimi K3 é o maior modelo de pesos abertos já lançado: 2,8 trilhões de parâmetros, 1 M de tokens de contexto e raciocínio nativo. Veja para que serve.
Kimi K3 vale a pena para programar? Prós, contras e para quem faz sentido
Kimi K3 lidera o Frontend Code Arena, tem 1M de tokens de contexto e API mais barata que os rivais. Mas no teste prático ficou atrás. Vale a pena?
