Como usar o Kimi K3 no n8n e quanto a conta de tokens cai em relação ao GPT e ao Claude?

Usar o Kimi K3 no n8n é direto: o n8n tem nó oficial da Moonshot Kimi e um sub-nó Moonshot Kimi Chat Model, que pluga o modelo como cérebro de AI Agents e chains. Você cria a chave na Kimi API Platform, cola na credencial da Moonshot e escolhe o modelo no campo Model (que vem com kimi-k2.5 de padrão). Na conta por 1 milhão de tokens, o Kimi K3 sai por US$ 3,00 de entrada e US$ 15,00 de saída na Moonshot, contra US$ 10,00 e US$ 50,00 do Claude Fable 5 e US$ 5,00 e US$ 30,00 do GPT-5.6 Sol
Fala aí, beleza? A Moonshot lançou o Kimi K3 em 16 de julho de 2026 e publicou os pesos abertos no dia 27, e o n8n já tem nó oficial da Moonshot Kimi esperando ele lá na paleta
Aí a conta começa a ficar interessante: o Kimi K3 sai por US$ 3,00 por 1 milhão de tokens de entrada na API da Moonshot, enquanto o Claude Fable 5 cobra US$ 10,00 pela mesma coisa
Neste post tu vai ver as duas partes da história: o passo a passo de plugar o modelo como cérebro do seu fluxo e a conta comparada com GPT e Claude, com preço na mesa
E já adianto uma coisa, pra ninguém sair daqui achando que comprou fórmula mágica: "barato" mudou de dono em julho de 2026, então não vou te vender a ideia de que o Kimi é sempre a opção mais econômica… a tabela lá embaixo conta essa parte
O que você precisa antes de começar:
A lista é curta, se liga:
- uma instância do n8n com os nós de IA disponíveis
- uma conta na Kimi API Platform
- uma chave de API criada no console da plataforma
Só isso, sem PC da Nasa, sem infra extra 🙂
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 114 aulas
- 4 projetos
- 9h 18min
Nó ou sub-nó? Escolhe certo antes de arrastar
Essa é a parte que mais confunde quem chega agora, então bora separar antes de você arrastar a coisa errada pra tela
O Moonshot Kimi é um nó de ação: ele conecta seu fluxo aos modelos Kimi e tem duas operações, Message a model e Analyze image
Já o Moonshot Kimi Chat Model é um sub-nó, um cluster node do LangChain
E o que significa isso? Significa que ele não roda sozinho: ele pluga embaixo de um AI Agent ou de uma chain e vira o CÉREBRO daquilo, conectando na plataforma da Moonshot pela API compatível com OpenAI
Se você conhece o jeito que o n8n encaixa modelo de chat no agente, é exatamente esse esquema de peça que entra por baixo
Os identificadores internos ajudam a achar cada um sem erro:
n8n-nodes-langchain.moonshot = nó Moonshot Kimi (ação)
n8n-nodes-langchain.lmchatmoonshot = sub-nó Moonshot Kimi Chat Model
Regra prática: quer mandar UMA mensagem e pegar a resposta de volta? Nó de ação
Quer que o modelo pense dentro de um agente? Sub-nó de chat
Passo a passo: usando o Kimi K3 como cérebro do seu AI Agent no n8n
Bora ver na prática?
- Crie a chave de API no console da Kimi API Platform
No console você vai em API Keys, clica em Create API Key, informa o nome e o projeto, e copia a chave que aparece
O erro comum deste passo: fechar a tela sem copiar a chave. Chave de API é aquele tipo de coisa que você vê uma vez e depois chora, então copia e guarda antes de sair dali
- Cole a chave na credencial da Moonshot dentro do n8n
A credencial da Moonshot no n8n existe justamente pra guardar essa chave, e é ela que os dois nós vão usar depois
O erro comum deste passo: criar a conta na plataforma e achar que já está tudo autenticado. Não está. A credencial pede a chave criada no console, não o seu login
- Adicione o sub-nó Moonshot Kimi Chat Model e conecte no AI Agent (ou na chain)
É aqui que o Kimi vira o cérebro do fluxo, e não só mais uma caixinha que responde
O erro comum deste passo: arrastar o nó de ação Moonshot Kimi achando que é o cérebro. O nó de ação serve pra mandar mensagem e analisar imagem, quem entra como modelo de chat do agente é o sub-nó
- Abra o campo Model e escolha o modelo
O campo Model do sub-nó é do tipo lista de opções e vem com kimi-k2.5 como padrão
O que você quer ali é o K3:
kimi-k3
Esse é um model ID válido na API da Moonshot, a Kimi API Platform reconhece ele
O erro comum deste passo, e esse é o mais caro da lista: deixar o default kimi-k2.5 quieto lá
O kimi-k2.5 e a série moonshot-v1 já não são oferecidos a novos cadastros na plataforma da Kimi e têm desligamento marcado pro dia 31 de agosto, com recomendação oficial de migrar pro modelo mais novo
Tome cuidado! Fluxo em produção com modelo em sunset é dor de cabeça agendada
E uma honestidade aqui, porque eu não vou inventar caminho de menu pra você: a documentação do sub-nó só mostra o padrão kimi-k2.5 e não publica a lista completa de opções do campo
Então abre o campo e confere o que aparece na sua versão, beleza?
Ajustes do nó que mudam sua conta de tokens
Essa seção é a que mais gente pula e depois se assusta com a fatura
O sub-nó de chat expõe um monte de parâmetro de ajuste, e alguns deles são alavanca DIRETA de custo:
- Maximum number of tokens, default
-1, que quer dizer "usa o padrão do modelo" - Response format, default
text - Frequency Penalty e Presence Penalty, ambos em
0 - temperatura, top-p, timeout e número de tentativas
Repara no primeiro: com -1 você não colocou teto nenhum de saída, quem decide o tamanho é o modelo
Em automação que dispara 500 vezes por dia, teto de saída não é preciosismo, é dinheiro
O número de tentativas e o timeout entram na mesma conversa: chamada que reexecuta é chamada cobrada de novo
E aí tem os dois fatos que mudam o jogo em automação de verdade
O Kimi K3 tem janela de contexto de 1.048.576 tokens e a tarifa é plana em toda essa janela, sem cobrança extra por prompt longo
Junta isso com o cache a US$ 0,30 por 1 milhão de tokens e você tem o cenário perfeito pra workflow: prompt fixo, gigante, repetido mil vezes, que é o padrão de quase todo fluxo de n8n
Quem já organiza o próprio fluxo em subworkflows para reuso sai na frente aqui, porque o mesmo bloco de instrução vive num lugar só e repete igualzinho a cada execução
E vale o mesmo raciocínio pras automações de n8n voltadas pra vendas, que costumam rodar o dia inteiro com o mesmo contexto de produto colado no prompt
Kimi K3, GPT e Claude: a conta por 1 milhão de tokens
Agora a parte que você rolou até aqui pra ver 😀
| Modelo (onde) | Entrada (1M) | Saída (1M) | Cache lido (1M) |
|---|---|---|---|
| Kimi K3 (Moonshot) | US$ 3,00 | US$ 15,00 | US$ 0,30 |
| Kimi K3 (OpenRouter) | US$ 2,80 | US$ 14,00 | não informado |
| GPT-5.6 Sol | US$ 5,00 | US$ 30,00 | não informado |
| GPT-5.6 Terra (após o corte) | US$ 2,00 | US$ 12,00 | não informado |
| GPT-5.6 Luna (após o corte) | US$ 0,20 | US$ 1,20 | não informado |
| Claude Fable 5 | US$ 10,00 | US$ 50,00 | US$ 1,00 |
Traduzindo em múltiplos honestos, sem drama:
Contra o Claude Fable 5, o Kimi K3 na Moonshot custa cerca de um terço na entrada, um terço na saída e um terço no cache lido
Contra o GPT-5.6 Sol, a distância é grande dos dois lados: a saída do Kimi é metade do preço (US$ 15,00 contra US$ 30,00) e a entrada também cai forte, de US$ 5,00 pra US$ 3,00
E aí vem a virada: em 30 de julho de 2026 a OpenAI cortou o preço do GPT-5.6 Luna em 80% e do GPT-5.6 Terra em 20%, e o Sol ficou como estava
Com isso, o Luna passou pra US$ 0,20 de entrada e US$ 1,20 de saída, ou seja, bem mais barato que o Kimi K3
Só que etiqueta não é a história inteira
Na página viva do Artificial Analysis, o Kimi K3 (max) marca 60 no Intelligence Index e a versão low marca 47
Comparar preço sem olhar o que o modelo entrega é o caminho mais rápido pra economizar token e gastar em retrabalho
Vale trocar o modelo do seu fluxo pelo Kimi K3?
Depende do perfil do seu fluxo, e vou por partes
Se hoje você roda Claude Fable 5 em tarefa repetitiva: a diferença por token é grande, e o cache a US$ 0,30 por 1M pesa a favor num fluxo que repete o mesmo prompt o dia todo
Se hoje você roda GPT-5.6 Sol: também sobra margem, e sobra na entrada e na saída, com a saída pela metade do preço
Se você só quer o mais barato possível: aí a resposta honesta é que o Kimi deixou de ser sinônimo disso depois do corte de 30 de julho, o GPT-5.6 Luna ficou abaixo dele na entrada e na saída
E o que o K3 traz além de preço? 2,8 trilhões de parâmetros, 1.048.576 tokens de contexto com tarifa plana e entrada multimodal nativa, num modelo lançado em 16 de julho de 2026 e com pesos abertos publicados em 27 de julho
Pra fluxo que engole documento grande ou imagem, isso muda mais a decisão do que dois dólares por milhão
Conclusão
O caminho é curto e sem mistério: chave criada no console da Kimi API Platform, chave colada na credencial da Moonshot, sub-nó Moonshot Kimi Chat Model plugado no AI Agent e o modelo escolhido no campo Model
Meu conselho de próximo passo é montar um fluxo pequeno, um só, apontando pro kimi-k3 e medir o consumo real do SEU caso antes de sair migrando tudo
Cada automação tem um perfil de prompt diferente, e a economia da tabela só vira economia de verdade quando bate com o seu volume
E vai lá dar uma olhada nos fluxos antigos: se algum ainda estiver no kimi-k2.5, resolve isso antes do desligamento de 31 de agosto
Se curtiu, dá uma passada nos outros conteúdos de Kimi e de n8n aqui do blog, tem bastante coisa boa pra fuçar
até o próximo post! =)
Perguntas frequentes
Qual é o model ID do Kimi K3 pra colocar no campo Model do n8n?
É kimi-k3, esse é o identificador válido reconhecido pela API da Moonshot na Kimi API Platform. O campo Model do sub-nó Moonshot Kimi Chat Model vem com kimi-k2.5 como padrão, então você precisa trocar manualmente pra kimi-k3.
Dá pra usar o Kimi K3 num nó de ação simples, sem montar um AI Agent?
Dá sim. O nó Moonshot Kimi (n8n-nodes-langchain.moonshot) tem as operações Message a model e Analyze image, feitas justamente pra mandar uma mensagem e receber a resposta direto, sem precisar de agente. Já o sub-nó Moonshot Kimi Chat Model é outra peça, ela pluga embaixo de um AI Agent ou de uma chain pra virar o cérebro do fluxo.
Quanto custa 1 milhão de tokens do Kimi K3 na API oficial da Moonshot?
US$ 3,00 por 1 milhão de tokens de entrada e US$ 15,00 por 1 milhão de tokens de saída. Quando o cache é aproveitado, o custo cai pra US$ 0,30 por 1 milhão de tokens, e essa tarifa é plana em toda a janela de 1.048.576 tokens de contexto, sem cobrança extra pra prompt longo.
Rodar o Kimi K3 pelo OpenRouter sai mais barato do que direto na Moonshot?
Sim, um pouco. No OpenRouter o Kimi K3 sai por US$ 2,80 por 1 milhão de tokens de entrada e US$ 14,00 por 1 milhão de saída, contra US$ 3,00 e US$ 15,00 na API oficial da Moonshot. A diferença é pequena, então o critério de escolha costuma ser mais sobre onde você já centraliza suas credenciais do que sobre economia.
Ainda posso deixar o fluxo no n8n usando kimi-k2.5?
Só se você já tinha cadastro antes do corte, porque kimi-k2.5 e a série moonshot-v1 pararam de ser oferecidos a novos cadastros na plataforma da Kimi. O desligamento total está marcado pra 31 de agosto, e a orientação oficial é migrar pro kimi-k3 antes disso pra não perder o fluxo em produção.
O Kimi K3 é sempre mais barato que Claude e GPT?
Não sempre. Contra o Claude Fable 5 (US$ 10,00 entrada / US$ 50,00 saída) e o GPT-5.6 Sol (US$ 5,00 entrada / US$ 30,00 saída) o Kimi K3 sai na frente em preço. Mas depois do corte de 30 de julho de 2026, o GPT-5.6 Luna caiu pra US$ 0,20 entrada e US$ 1,20 saída por 1 milhão, ficando mais barato que o Kimi K3 nesse comparativo específico.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Como usar o Kimi K3: primeiros passos para quem nunca mexeu
Kimi K3 tem acesso gratuito via kimi.com, sem cartão nem fila de espera. Guia passo a passo para criar conta e fazer seu primeiro teste com o novo modelo da Moonshot AI.
O que é o Kimi K3 e para que serve?
Kimi K3 é o maior modelo de pesos abertos já lançado: 2,8 trilhões de parâmetros, 1 M de tokens de contexto e raciocínio nativo. Veja para que serve.
Kimi K3 no vibe coding: casos de uso reais no fluxo de desenvolvimento
Kimi K3 no vibe coding: veja casos de uso reais de como o modelo da Moonshot AI entra no fluxo de desenvolvimento frontend e de código na prática.
