Como usar o Kimi K3 no n8n e quanto a conta de tokens cai em relação ao GPT e ao Claude?

Kimi K3 no n8n conectado como modelo de IA nos fluxos de automação
Resposta rápida

Usar o Kimi K3 no n8n é direto: o n8n tem nó oficial da Moonshot Kimi e um sub-nó Moonshot Kimi Chat Model, que pluga o modelo como cérebro de AI Agents e chains. Você cria a chave na Kimi API Platform, cola na credencial da Moonshot e escolhe o modelo no campo Model (que vem com kimi-k2.5 de padrão). Na conta por 1 milhão de tokens, o Kimi K3 sai por US$ 3,00 de entrada e US$ 15,00 de saída na Moonshot, contra US$ 10,00 e US$ 50,00 do Claude Fable 5 e US$ 5,00 e US$ 30,00 do GPT-5.6 Sol

Fala aí, beleza? A Moonshot lançou o Kimi K3 em 16 de julho de 2026 e publicou os pesos abertos no dia 27, e o n8n já tem nó oficial da Moonshot Kimi esperando ele lá na paleta

Aí a conta começa a ficar interessante: o Kimi K3 sai por US$ 3,00 por 1 milhão de tokens de entrada na API da Moonshot, enquanto o Claude Fable 5 cobra US$ 10,00 pela mesma coisa

Neste post tu vai ver as duas partes da história: o passo a passo de plugar o modelo como cérebro do seu fluxo e a conta comparada com GPT e Claude, com preço na mesa

E já adianto uma coisa, pra ninguém sair daqui achando que comprou fórmula mágica: "barato" mudou de dono em julho de 2026, então não vou te vender a ideia de que o Kimi é sempre a opção mais econômica… a tabela lá embaixo conta essa parte

O que você precisa antes de começar:

A lista é curta, se liga:

  • uma instância do n8n com os nós de IA disponíveis
  • uma conta na Kimi API Platform
  • uma chave de API criada no console da plataforma

Só isso, sem PC da Nasa, sem infra extra 🙂

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 114 aulas
  • 4 projetos
  • 9h 18min

Nó ou sub-nó? Escolhe certo antes de arrastar

Essa é a parte que mais confunde quem chega agora, então bora separar antes de você arrastar a coisa errada pra tela

O Moonshot Kimi é um nó de ação: ele conecta seu fluxo aos modelos Kimi e tem duas operações, Message a model e Analyze image

Já o Moonshot Kimi Chat Model é um sub-nó, um cluster node do LangChain

E o que significa isso? Significa que ele não roda sozinho: ele pluga embaixo de um AI Agent ou de uma chain e vira o CÉREBRO daquilo, conectando na plataforma da Moonshot pela API compatível com OpenAI

Se você conhece o jeito que o n8n encaixa modelo de chat no agente, é exatamente esse esquema de peça que entra por baixo

Os identificadores internos ajudam a achar cada um sem erro:

n8n-nodes-langchain.moonshot         = nó Moonshot Kimi (ação)
n8n-nodes-langchain.lmchatmoonshot   = sub-nó Moonshot Kimi Chat Model

Regra prática: quer mandar UMA mensagem e pegar a resposta de volta? Nó de ação

Quer que o modelo pense dentro de um agente? Sub-nó de chat

Passo a passo: usando o Kimi K3 como cérebro do seu AI Agent no n8n

Bora ver na prática?

  1. Crie a chave de API no console da Kimi API Platform

No console você vai em API Keys, clica em Create API Key, informa o nome e o projeto, e copia a chave que aparece

O erro comum deste passo: fechar a tela sem copiar a chave. Chave de API é aquele tipo de coisa que você vê uma vez e depois chora, então copia e guarda antes de sair dali

  1. Cole a chave na credencial da Moonshot dentro do n8n

A credencial da Moonshot no n8n existe justamente pra guardar essa chave, e é ela que os dois nós vão usar depois

O erro comum deste passo: criar a conta na plataforma e achar que já está tudo autenticado. Não está. A credencial pede a chave criada no console, não o seu login

  1. Adicione o sub-nó Moonshot Kimi Chat Model e conecte no AI Agent (ou na chain)

É aqui que o Kimi vira o cérebro do fluxo, e não só mais uma caixinha que responde

O erro comum deste passo: arrastar o nó de ação Moonshot Kimi achando que é o cérebro. O nó de ação serve pra mandar mensagem e analisar imagem, quem entra como modelo de chat do agente é o sub-nó

  1. Abra o campo Model e escolha o modelo

O campo Model do sub-nó é do tipo lista de opções e vem com kimi-k2.5 como padrão

O que você quer ali é o K3:

kimi-k3

Esse é um model ID válido na API da Moonshot, a Kimi API Platform reconhece ele

O erro comum deste passo, e esse é o mais caro da lista: deixar o default kimi-k2.5 quieto lá

O kimi-k2.5 e a série moonshot-v1 já não são oferecidos a novos cadastros na plataforma da Kimi e têm desligamento marcado pro dia 31 de agosto, com recomendação oficial de migrar pro modelo mais novo

Tome cuidado! Fluxo em produção com modelo em sunset é dor de cabeça agendada

E uma honestidade aqui, porque eu não vou inventar caminho de menu pra você: a documentação do sub-nó só mostra o padrão kimi-k2.5 e não publica a lista completa de opções do campo

Então abre o campo e confere o que aparece na sua versão, beleza?

Ajustes do nó que mudam sua conta de tokens

Essa seção é a que mais gente pula e depois se assusta com a fatura

O sub-nó de chat expõe um monte de parâmetro de ajuste, e alguns deles são alavanca DIRETA de custo:

  • Maximum number of tokens, default -1, que quer dizer "usa o padrão do modelo"
  • Response format, default text
  • Frequency Penalty e Presence Penalty, ambos em 0
  • temperatura, top-p, timeout e número de tentativas

Repara no primeiro: com -1 você não colocou teto nenhum de saída, quem decide o tamanho é o modelo

Em automação que dispara 500 vezes por dia, teto de saída não é preciosismo, é dinheiro

O número de tentativas e o timeout entram na mesma conversa: chamada que reexecuta é chamada cobrada de novo

E aí tem os dois fatos que mudam o jogo em automação de verdade

O Kimi K3 tem janela de contexto de 1.048.576 tokens e a tarifa é plana em toda essa janela, sem cobrança extra por prompt longo

Junta isso com o cache a US$ 0,30 por 1 milhão de tokens e você tem o cenário perfeito pra workflow: prompt fixo, gigante, repetido mil vezes, que é o padrão de quase todo fluxo de n8n

Quem já organiza o próprio fluxo em subworkflows para reuso sai na frente aqui, porque o mesmo bloco de instrução vive num lugar só e repete igualzinho a cada execução

E vale o mesmo raciocínio pras automações de n8n voltadas pra vendas, que costumam rodar o dia inteiro com o mesmo contexto de produto colado no prompt

Kimi K3, GPT e Claude: a conta por 1 milhão de tokens

Agora a parte que você rolou até aqui pra ver 😀

Modelo (onde) Entrada (1M) Saída (1M) Cache lido (1M)
Kimi K3 (Moonshot) US$ 3,00 US$ 15,00 US$ 0,30
Kimi K3 (OpenRouter) US$ 2,80 US$ 14,00 não informado
GPT-5.6 Sol US$ 5,00 US$ 30,00 não informado
GPT-5.6 Terra (após o corte) US$ 2,00 US$ 12,00 não informado
GPT-5.6 Luna (após o corte) US$ 0,20 US$ 1,20 não informado
Claude Fable 5 US$ 10,00 US$ 50,00 US$ 1,00

Traduzindo em múltiplos honestos, sem drama:

Contra o Claude Fable 5, o Kimi K3 na Moonshot custa cerca de um terço na entrada, um terço na saída e um terço no cache lido

Contra o GPT-5.6 Sol, a distância é grande dos dois lados: a saída do Kimi é metade do preço (US$ 15,00 contra US$ 30,00) e a entrada também cai forte, de US$ 5,00 pra US$ 3,00

E aí vem a virada: em 30 de julho de 2026 a OpenAI cortou o preço do GPT-5.6 Luna em 80% e do GPT-5.6 Terra em 20%, e o Sol ficou como estava

Com isso, o Luna passou pra US$ 0,20 de entrada e US$ 1,20 de saída, ou seja, bem mais barato que o Kimi K3

Só que etiqueta não é a história inteira

Na página viva do Artificial Analysis, o Kimi K3 (max) marca 60 no Intelligence Index e a versão low marca 47

Comparar preço sem olhar o que o modelo entrega é o caminho mais rápido pra economizar token e gastar em retrabalho

Vale trocar o modelo do seu fluxo pelo Kimi K3?

Depende do perfil do seu fluxo, e vou por partes

Se hoje você roda Claude Fable 5 em tarefa repetitiva: a diferença por token é grande, e o cache a US$ 0,30 por 1M pesa a favor num fluxo que repete o mesmo prompt o dia todo

Se hoje você roda GPT-5.6 Sol: também sobra margem, e sobra na entrada e na saída, com a saída pela metade do preço

Se você só quer o mais barato possível: aí a resposta honesta é que o Kimi deixou de ser sinônimo disso depois do corte de 30 de julho, o GPT-5.6 Luna ficou abaixo dele na entrada e na saída

E o que o K3 traz além de preço? 2,8 trilhões de parâmetros, 1.048.576 tokens de contexto com tarifa plana e entrada multimodal nativa, num modelo lançado em 16 de julho de 2026 e com pesos abertos publicados em 27 de julho

Pra fluxo que engole documento grande ou imagem, isso muda mais a decisão do que dois dólares por milhão

Conclusão

O caminho é curto e sem mistério: chave criada no console da Kimi API Platform, chave colada na credencial da Moonshot, sub-nó Moonshot Kimi Chat Model plugado no AI Agent e o modelo escolhido no campo Model

Meu conselho de próximo passo é montar um fluxo pequeno, um só, apontando pro kimi-k3 e medir o consumo real do SEU caso antes de sair migrando tudo

Cada automação tem um perfil de prompt diferente, e a economia da tabela só vira economia de verdade quando bate com o seu volume

E vai lá dar uma olhada nos fluxos antigos: se algum ainda estiver no kimi-k2.5, resolve isso antes do desligamento de 31 de agosto

Se curtiu, dá uma passada nos outros conteúdos de Kimi e de n8n aqui do blog, tem bastante coisa boa pra fuçar

até o próximo post! =)

Perguntas frequentes

Qual é o model ID do Kimi K3 pra colocar no campo Model do n8n?

É kimi-k3, esse é o identificador válido reconhecido pela API da Moonshot na Kimi API Platform. O campo Model do sub-nó Moonshot Kimi Chat Model vem com kimi-k2.5 como padrão, então você precisa trocar manualmente pra kimi-k3.

Dá pra usar o Kimi K3 num nó de ação simples, sem montar um AI Agent?

Dá sim. O nó Moonshot Kimi (n8n-nodes-langchain.moonshot) tem as operações Message a model e Analyze image, feitas justamente pra mandar uma mensagem e receber a resposta direto, sem precisar de agente. Já o sub-nó Moonshot Kimi Chat Model é outra peça, ela pluga embaixo de um AI Agent ou de uma chain pra virar o cérebro do fluxo.

Quanto custa 1 milhão de tokens do Kimi K3 na API oficial da Moonshot?

US$ 3,00 por 1 milhão de tokens de entrada e US$ 15,00 por 1 milhão de tokens de saída. Quando o cache é aproveitado, o custo cai pra US$ 0,30 por 1 milhão de tokens, e essa tarifa é plana em toda a janela de 1.048.576 tokens de contexto, sem cobrança extra pra prompt longo.

Rodar o Kimi K3 pelo OpenRouter sai mais barato do que direto na Moonshot?

Sim, um pouco. No OpenRouter o Kimi K3 sai por US$ 2,80 por 1 milhão de tokens de entrada e US$ 14,00 por 1 milhão de saída, contra US$ 3,00 e US$ 15,00 na API oficial da Moonshot. A diferença é pequena, então o critério de escolha costuma ser mais sobre onde você já centraliza suas credenciais do que sobre economia.

Ainda posso deixar o fluxo no n8n usando kimi-k2.5?

Só se você já tinha cadastro antes do corte, porque kimi-k2.5 e a série moonshot-v1 pararam de ser oferecidos a novos cadastros na plataforma da Kimi. O desligamento total está marcado pra 31 de agosto, e a orientação oficial é migrar pro kimi-k3 antes disso pra não perder o fluxo em produção.

O Kimi K3 é sempre mais barato que Claude e GPT?

Não sempre. Contra o Claude Fable 5 (US$ 10,00 entrada / US$ 50,00 saída) e o GPT-5.6 Sol (US$ 5,00 entrada / US$ 30,00 saída) o Kimi K3 sai na frente em preço. Mas depois do corte de 30 de julho de 2026, o GPT-5.6 Luna caiu pra US$ 0,20 entrada e US$ 1,20 saída por 1 milhão, ficando mais barato que o Kimi K3 nesse comparativo específico.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares