Quanto custa por mês um atendimento com IA no WhatsApp? A conta fechada de VPS, Evolution API, n8n e tokens

tabela do custo de atendimento com IA no WhatsApp somando VPS, Evolution API, n8n e tokens do modelo
Resposta rápida

O custo de atendimento com IA no WhatsApp se resume a quatro linhas: VPS, Evolution API, n8n e tokens do modelo. Duas delas custam zero: a Evolution API é Apache 2.0 com ativação gratuita e o n8n Community auto-hospedado roda com execuções ilimitadas. O gasto fixo mesmo é a VPS, de US$ 6,49 a US$ 25,99 por mês (R$ 33,28 a R$ 133,29 na taxa de US$ 1 = R$ 5,1284). O resto varia: tokens vão de US$ 0,20 a US$ 30 por milhão, e a rota oficial da Meta ainda cobra por mensagem entregue

Todo tutorial de WhatsApp com n8n termina no mesmo lugar: o bot respondendo, o print bonito, e zero informação sobre quanto aquilo vai custar no dia 30

Aqui a gente fecha a conta

São quatro linhas pra somar: a VPS que segura tudo, a Evolution API, o n8n e os tokens do modelo que escreve as respostas

E, dependendo da rota que você escolher, entra uma quinta linha: a cobrança da Meta por mensagem entregue

No fim eu monto três tamanhos de operação, do setup de quem está só estudando até quem já tem cliente pagando

As quatro linhas da conta: o que é fixo e o que é variável

Antes de destrinchar item a item, o mapa

Linha da conta Como é cobrado Faixa de valor
VPS Mensalidade fixa US$ 6,49 a US$ 25,99 por mês
Evolution API auto-hospedada Gratuita, com ativação de licença sem cobrança Zero
n8n Community auto-hospedado Gratuito, execuções ilimitadas Zero
n8n Cloud (Starter) Por execução do workflow €20 por mês, 2.500 execuções
Modelo de IA Por milhão de tokens US$ 0,20 a US$ 30 por milhão, conforme modelo e se é entrada ou saída
Meta (só na rota oficial) Por mensagem entregue Serviço gratuito na janela; utilidade e autenticação US$ 0,0068; marketing US$ 0,0625

Repara na assimetria: as duas peças que todo mundo acha que são o gasto principal (Evolution e n8n) custam zero na versão auto-hospedada

O que cobra de verdade é o servidor onde elas moram, e o modelo que pensa 🙂

Quanto custa a VPS para rodar Evolution API e n8n

Aqui mora o gasto previsível, o que cai na fatura todo mês mesmo se ninguém mandar mensagem

O n8n publica requisito mínimo e recomendado, e essa diferença é o que separa um servidor de estudo de um servidor que aguenta cliente

Cenário vCPU RAM Disco
Mínimo para o n8n auto-hospedado 1 2 GB 20 GB SSD
Recomendado para produção 2 a 4 4 a 8 GB 40 a 80 GB NVMe SSD

Roda com 1 GB de RAM? Roda, mas a própria documentação não recomenda por causa de erro de memória

Ou seja: economizar exatamente aí é o tipo de economia que volta como fluxo travado no meio do atendimento

Um detalhe que pesa no dimensionamento: o n8n recomenda PostgreSQL dedicado por instância em vez do SQLite padrão

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 120 aulas
  • 4 projetos
  • 9h 45min

O queue mode até funciona com SQLite, mas o recomendado é o Postgres, e Postgres na mesma máquina quer RAM

Agora os planos que atendem cada faixa:

Plano Configuração Preço
Hostinger KVM 1 1 vCPU, 4 GB RAM, 50 GB NVMe, 4 TB de tráfego, Ubuntu 24.04 US$ 6,49 por mês
Hostinger KVM 2 2 vCPUs, 8 GB RAM, 100 GB NVMe SSD US$ 8,79 por mês
Topo da linha KVM Planos maiores da mesma linha Até US$ 25,99 por mês
Contabo Cloud VPS 10 (UE) Plano de entrada, data center na União Europeia €5,50 por mês
Contabo Cloud VPS 10 (EUA leste) Mesmo plano, outro data center €7,05 por mês (já com €1,55 de taxa de localização)

Deixei cada preço na moeda original de propósito: chutar conversão de câmbio seria inventar número, e o dólar de hoje não é o do dia em que você vai contratar

Duas pegadinhas de checkout que mudam a primeira fatura:

  • A Contabo cobra taxa de setup no Cloud VPS 10 quando o contrato é de 1 mês ou 6 meses; do VPS 20 pra cima, e em prazos maiores, não tem
  • A tarifa de localização não é a mesma em todo data center, como dá pra ver na diferença entre UE e EUA no mesmo plano

Se você quer o comparativo de preço por faixa com mais provedores, eu abri isso separado no post sobre quanto custa uma VPS hoje

Evolution API é gratuita mesmo? E o n8n, Community ou Cloud?

Essa é a dúvida que mais aparece, e a resposta curta é: sim, as duas têm caminho gratuito, mas com condições diferentes

Camada Licença ou plano Custo O que limita
Evolution API auto-hospedada Mantida pela Evolution Foundation, repositório sob Apache 2.0 Gratuita Sem limite de instâncias, sem limite de mensagens e sem feature flag bloqueando funcionalidade
n8n Community auto-hospedado Gratuito Zero Execuções ilimitadas, workflows ilimitados, sem restrição de nodes
n8n Cloud Starter Plano de entrada €20 por mês 2.500 execuções mensais

A Evolution ganhou uma etapa nova no meio do caminho: a partir da versão 2.4.0, toda instância precisa ser ativada contra o servidor de licenciamento antes de servir tráfego da API

Antes que você feche a aba achando que virou pago: a ativação é gratuita e os tiers community não têm cobrança em nenhum momento

O que mudou não foi o preço, foi o processo

Do lado do n8n, tem uma notícia boa e uma ruim

A boa: desde abril de 2026 todos os planos têm workflows ativos ilimitados, e a cobrança ficou só nas execuções

A ruim: o n8n Cloud não tem mais plano gratuito permanente, só teste de 14 dias

Por que "execução" muda a sua estimativa:

Esse ponto é o que mais engana quem vem de ferramenta que cobra por tarefa

No n8n, uma execução é uma rodada do workflow inteiro, não importa se ele tem 3 nodes ou 40

Então um fluxo de atendimento gordo, com classificação de intenção, consulta em banco, chamada do modelo e resposta, continua contando 1

Quer dizer: quem atende muita conversa deve olhar quantas VEZES o fluxo dispara, não o tamanho dele

E, no auto-hospedado, esse número nem entra na conta: execução ilimitada é ilimitada mesmo, o teto passa a ser a sua VPS

Tokens do modelo: quanto custa cada resposta da IA

Aqui a conta deixa de ser mensalidade e vira consumo

Todo mundo cobra por milhão de tokens, separando o que entra (o prompt, o histórico da conversa, o contexto do cliente) do que sai (a resposta)

Modelo Entrada (por milhão) Saída (por milhão)
Claude Haiku US$ 1 US$ 5
Claude Sonnet 5 (promocional até 31/08/2026) US$ 2 US$ 10
Claude Sonnet 5 (depois de 31/08/2026) US$ 3 US$ 15
GPT-5.6 Luna US$ 0,20 US$ 1,20
GPT-5.6 Terra US$ 2 US$ 12
GPT-5.6 Sol US$ 5 US$ 30
Gemini 3.1 Flash-Lite US$ 0,25 (texto, imagem e vídeo) US$ 1,50

No Flash-Lite tem uma linha extra que interessa muito pra WhatsApp: áudio na entrada custa US$ 0,50 por milhão, o dobro do texto

Se o seu atendimento recebe muito áudio, isso não é detalhe 😀

Repara na distância entre as pontas: a saída do Sol custa 25 vezes a saída do Luna

Mesma tarefa, mesma quantidade de conversa, fatura completamente diferente

Os redutores que quase ninguém liga:

Antes de trocar de modelo pra economizar, dá pra mexer no jeito de chamar:

  • Na Anthropic, prompt caching chega a 90% de economia e processamento em batch corta 50%
  • Na OpenAI, Batch e Flex custam 50% da tarifa padrão, enquanto o Fast mode custa o dobro em Sol, Terra e Luna
  • E teve corte de tabela mesmo: em 30 de julho de 2026 a OpenAI baixou 80% o GPT-5.6 Luna e 20% o Terra

Prompt caching é o redutor mais óbvio pra atendimento: a instrução do bot, o catálogo, as regras da empresa, tudo isso vai igual em toda conversa

É exatamente o padrão que o cache foi feito pra pegar

Evolution API ou API oficial da Meta: onde a conta muda de forma

Aqui não é só diferença de preço, é diferença de FORMATO da conta

Rota O que você paga Cobrança por mensagem
Evolution API auto-hospedada Custo fixo da VPS, software gratuito Não tem
WhatsApp Business Platform (oficial) Mensalidade e, em muitos provedores, markup do BSP Por mensagem entregue

Na rota oficial, o modelo antigo de cobrança por conversa de 24 horas está marcado como deprecated: desde 1 de julho de 2025 a cobrança é por mensagem entregue

As tarifas para números do Brasil, por categoria de template:

Categoria Por mensagem entregue
Marketing US$ 0,0625
Utilidade US$ 0,0068
Autenticação US$ 0,0068
Serviço (dentro da janela de 24 horas) Gratuito

E tem três isenções que mudam muito a conta de quem faz atendimento reativo, aquele em que o cliente puxa assunto primeiro:

  • Conversas de serviço são gratuitas pra todos os negócios desde 1 de novembro de 2024, inclusive em experiências conversacionais com IA
  • Mensagens que não são template (texto, imagem e afins) não são cobradas desde a mesma data, desde que a janela de atendimento esteja aberta
  • Templates de utilidade respondidos dentro da janela aberta também não são cobrados, desde 1 de julho de 2025

Traduzindo: quem só responde quem chamou tende a pagar pouco ou nada de mensagem na rota oficial

Quem dispara marketing paga por disparo, e aí a linha da Meta vira a maior da planilha

Dois avisos honestos antes de você fechar a planilha:

O primeiro é que existe uma cobrança separada, dirigida a AI Providers, por mensagens não-template entregues a usuários no Brasil, em vigor desde 16 de fevereiro de 2026

Em 13 de maio de 2026 a Meta parou de cobrar isso nos mercados da UE e do EEE, mas no Brasil segue valendo

Repara que essa linha não muda a tabela acima: a tabela é a conta do negócio que manda mensagem, e essa cobrança é dirigida a quem a Meta classifica como AI Provider

Se um bot próprio rodando em Evolution auto-hospedada se enquadra nessa definição eu não consegui confirmar, então não vou afirmar que sim nem que não

O segundo é que existem atualizações de preço anunciadas pra 1 de agosto de 2026 e 1 de outubro de 2026, envolvendo Meta Business Agent, mensagens de serviço e de utilidade

As datas estão confirmadas, os valores novos não estão publicados na página

Então marque essas datas no calendário pra refazer a conta, beleza?

A conta fechada em três tamanhos de operação

Agora somando tudo

Um aviso antes: eu separo de propósito o que é preço de tabela verificado do que depende do volume de cada negócio

Não existe número oficial de consumo médio de tokens por conversa de atendimento, e eu não vou inventar um pra deixar a tabela mais bonita

O que dá pra fazer é te entregar o fixo fechado e a fórmula do variável:

custo de tokens = (tokens de entrada / 1.000.000 x preço de entrada)
               + (tokens de saída  / 1.000.000 x preço de saída)

Roda uma semana com log ligado, pega a média real do SEU fluxo e joga na fórmula

Operação enxuta: estudando ou primeiro cliente

Composição: VPS de entrada, Evolution API auto-hospedada, n8n Community e um modelo barato, atendendo dentro da janela

Item Valor
VPS (KVM 1: 1 vCPU, 4 GB, 50 GB NVMe) US$ 6,49 por mês
Evolution API Gratuita
n8n Community Gratuito
Mensagens Sem cobrança na rota auto-hospedada
Tokens (GPT-5.6 Luna ou Gemini 3.1 Flash-Lite) Variável: de US$ 0,20 a US$ 0,25 por milhão de entrada
Fixo mensal US$ 6,49 por mês mais os tokens

O que faz subir: áudio na entrada (no Flash-Lite ele custa o dobro do texto) e histórico de conversa longo demais indo no prompt toda vez

Operação média: cliente rodando, volume real

Composição: VPS na faixa recomendada, com PostgreSQL dedicado na mesma máquina, e modelo intermediário

Item Valor
VPS (KVM 2: 2 vCPUs, 8 GB, 100 GB NVMe) US$ 8,79 por mês
Evolution API Gratuita
n8n Community Gratuito (ou n8n Cloud Starter a €20 por mês, com 2.500 execuções)
Tokens (Claude Sonnet 5 ou GPT-5.6 Terra) US$ 2 de entrada e US$ 10 a US$ 12 de saída por milhão
Fixo mensal US$ 8,79 por mês mais os tokens

O que faz subir: o modelo, principalmente na saída

Sonnet 5 está em preço promocional de lançamento até 31 de agosto de 2026, e depois disso a mesma operação fica mais cara sem você mexer em nada: entrada vai de US$ 2 pra US$ 3, saída de US$ 10 pra US$ 15

Se você escolheu o modelo pelo preço promocional, refaça a conta em setembro

Operação grande: muitos clientes ou rota oficial

Composição: VPS mais robusta e, se o negócio exige conta oficial, a linha da Meta entra na planilha

Item Valor
VPS (topo da linha KVM) Até US$ 25,99 por mês
Evolution API e n8n Community Gratuitos
Tokens (modelo mais forte, tipo GPT-5.6 Sol) US$ 5 de entrada e US$ 30 de saída por milhão
Mensagens de template (rota oficial) US$ 0,0625 marketing, US$ 0,0068 utilidade e autenticação, por mensagem entregue
Mensalidade e markup do BSP Não verificado, varia por provedor

Essa última linha é onde eu paro de dar número: cada BSP tem sua mensalidade e vários cobram markup por mensagem em cima da tarifa da Meta

Não existe tabela oficial única disso, então peça a proposta e some você mesmo

O que a montagem real na VPS revela sobre o custo

Tabela de preço é ótima, mas ela não conta o que acontece na hora de subir a coisa

No vídeo abaixo eu monto a operação inteira em um servidor só: um painel de instalação (EasyPanel), o n8n como motor das automações e a Evolution API fazendo a ponte com o WhatsApp

E a primeira coisa que eu defendo lá é justamente o que segura o custo: um VPS único comporta vários agentes e vários clientes ao mesmo tempo

Subir servidor novo por cliente é o jeito mais rápido de multiplicar a fatura sem multiplicar a receita

Esse raciocínio de dividir uma máquina só entre operações que não podem se atrapalhar é o mesmo que eu detalho no guia de isolar workloads no mesmo servidor

Eu rodo os meus próprios fluxos em VPS assim e, sinceramente, nunca tive dor de cabeça; quando precisei de suporte, fui respondido

Hoje eu já perdi a conta de quantos servidores mantenho, e a estrutura é sempre a mesma

Algumas decisões do vídeo que mexem direto no valor final:

  1. Escolha o plano pelo estágio, não pelo desejo. Quem está só estudando pega o contrato mais curto pra reduzir o desembolso; quem já tem cliente em vista fecha o contrato mais longo pelo desconto maior
  2. Não contrate por mês. Os valores promocionais moram nos contratos longos e não dá pra resgatar depois, então o mês avulso costuma ser o pior dos dois mundos
  3. O backup diário do checkout é opcional. Dá pra resolver backup por software dentro do próprio servidor, e aí é uma linha a menos na fatura
  4. Datacenter no Brasil. O fluxo do n8n responde mais rápido, e isso não custa nada a mais na escolha
  5. Subdomínios antes da instalação. Eu aponto três subdomínios pro IP do servidor (um pra Evolution API, um pro n8n e um pro painel) antes de instalar qualquer serviço

Sobre o painel: ele existe justamente pra quem não quer decorar comando de infraestrutura

Procura o serviço na lista, clica e instala, tipo dar dois cliques em um executável

E se você não quiser painel nenhum, a estrutura funciona igual em qualquer outro VPS, não é amarrada a provedor

Aliás, tem quem prefira pular até essa etapa: a Hostinger mantém um catálogo de aplicações de 1 clique no hPanel, com template da Evolution API e templates de n8n, inclusive n8n com queue mode

O atrito que ninguém avisa: a licença da v2.4.0

Esse é o ponto que mais gera susto hoje

Da versão 2.4.0 em diante, a instância precisa ser ativada contra o servidor de licenciamento antes de servir tráfego

Se você instala do jeito antigo e sai testando, vai bater na parede

O caminho pra quem automatiza deploy é a auto-ativação headless, sem passar pelo fluxo de registro no navegador: define a env EVOLUTION_OPERATOR_EMAIL e, no boot, o initializeRuntime chama o endpoint /v1/register/auto do servidor de licenciamento e ativa a instância

O erro comum aqui é presumir que deploy automatizado continua funcionando igual depois de atualizar

Não continua, e isso está registrado: a issue #2534 do repositório oficial reporta que a ativação obrigatória da v2.4.0 quebrou deployments automatizados e self-hosted

De novo: isso não vira custo em reais, vira custo em tempo

Só que tempo parado com cliente esperando resposta também é conta, né?

O que realmente pesa na fatura (e o que quase não pesa)

Veredito sem enfeite

O que quase não pesa: o software

Os dois pilares da operação são gratuitos no caminho auto-hospedado, e nenhum dos dois tem cobrança escondida por mensagem: Evolution API é Apache 2.0 com ativação sem custo, n8n Community é gratuito com execuções e workflows ilimitados

O que pesa de forma previsível: a VPS

É o único valor que você sabe de antemão, entre US$ 6,49 e US$ 25,99 por mês na linha que a gente olhou

O que pesa de forma imprevisível: o modelo e o volume de mensagem

Entre o GPT-5.6 Luna e o Sol tem uma diferença de 25 vezes na saída, e na rota oficial cada template de marketing entregue custa US$ 0,0625

São três decisões que mudam o valor final, nessa ordem de impacto:

  1. Modelo de IA. Aqui a variação é de ordens de grandeza, não de centavos; e antes de trocar de modelo, ligue prompt caching
  2. Rota Evolution auto-hospedada versus API oficial. Uma tem custo fixo e nenhuma cobrança por mensagem, a outra tem cobrança por mensagem entregue mais mensalidade e possível markup de BSP
  3. Tamanho da VPS. É a menor variação das três, e é justamente onde a maioria tenta economizar (com 1 GB de RAM e erro de memória no meio do atendimento)

Pra quem faz atendimento reativo, respondendo dentro da janela de 24 horas, a rota oficial é menos assustadora do que parece: serviço é gratuito, mensagem não-template é gratuita e template de utilidade respondido na janela também

Pra quem dispara marketing em volume, a linha da Meta vira a maior da planilha e nenhuma economia de VPS compensa

E pra quem está montando operação pra vários clientes, o self-hosted com um servidor bem dimensionado continua sendo o de custo marginal mais baixo, porque cliente novo não vira mensalidade nova

Próximo passo: monte sua planilha antes de subir o bot

A conta fecha assim: fixo pequeno, variável honesto e nenhuma surpresa se você medir antes

O roteiro pra fazer isso hoje:

  1. Estime o volume mensal de conversas e quantas delas são respostas dentro da janela versus disparos de template; isso já decide a rota
  2. Escolha o plano de VPS pela faixa recomendada (2 a 4 vCPUs, 4 a 8 GB de RAM, 40 a 80 GB de NVMe), lembrando que o Postgres dedicado mora na mesma máquina e quer memória
  3. Rode uma semana com log de tokens ligado e jogue a média real na fórmula de entrada e saída, em vez de confiar em estimativa de internet
  4. Escolha o modelo pela tabela, começando pelo mais barato que resolve; upgrade é fácil, downgrade depois de prometer resposta perfeita é que dói
  5. Marque as datas de revisão: 31 de agosto de 2026, quando o preço promocional do Sonnet 5 acaba, e 1 de agosto e 1 de outubro de 2026, quando entram as mudanças de preço anunciadas pela Meta

O ponto que eu queria deixar claro é esse: a parte cara de um atendimento com IA no WhatsApp não é a que os tutoriais mostram

Eles ensinam a montar e somem na hora da fatura

Agora você tem as quatro linhas, os preços de tabela e a fórmula do que sobra

Monta a planilha, roda uma semana e me conta o que deu no seu caso, tô curioso pra ver as médias reais de vocês =)

Até o próximo post!

Perguntas frequentes

Quanto custa o modelo de IA que gera as respostas do atendimento no WhatsApp?

Varia bastante conforme o modelo: o Claude Haiku cobra US$ 1 por milhão de tokens de entrada e US$ 5 de saída, enquanto o Claude Sonnet 5 está em preço promocional de US$ 2 de entrada e US$ 10 de saída até 31 de agosto de 2026 (depois sobe pra US$ 3 e US$ 15). Do lado da OpenAI, o GPT-5.6 Luna sai por US$ 0,20 de entrada e US$ 1,20 de saída, e o Gemini 3.1 Flash-Lite fica em US$ 0,25 de entrada e US$ 1,50 de saída. Dá pra reduzir isso com prompt caching, que chega a 90% de economia, ou processamento em batch, com 50%.

A Meta cobra por mensagem quando a IA responde dentro do WhatsApp?

Dentro da janela de atendimento de 24 horas, mensagens de serviço e mensagens que não são template não têm cobrança desde 1 de novembro de 2024, inclusive em experiências conversacionais com IA. Só entra tarifa quando é template: utilidade e autenticação saem a US$ 0,0068 por mensagem entregue e marketing a US$ 0,0625, sempre pra números do Brasil. E templates de utilidade respondidos dentro da janela aberta também não são cobrados desde 1 de julho de 2025.

Precisa pagar pela ativação de licença da Evolution API na versão 2.4.0?

Não, a ativação é gratuita e os tiers community não têm cobrança em nenhum momento, sem limite de instâncias nem de mensagens. O que mudou na 2.4.0 foi só o processo: toda instância precisa ser ativada contra o servidor de licenciamento antes de servir tráfego da API.

Dá pra rodar Evolution API e n8n na mesma VPS de 1 vCPU e 2 GB de RAM?

Dá, esse é justamente o mínimo publicado pelo n8n pra rodar auto-hospedado (1 vCPU, 2 GB de RAM e 20 GB de SSD). Mas pra produção o recomendado é bem maior: de 2 a 4 vCPUs, 4 a 8 GB de RAM e 40 a 80 GB de NVMe SSD, até porque o n8n recomenda PostgreSQL dedicado por instância, e Postgres na mesma máquina pede RAM. Roda até com 1 GB, mas a própria documentação não recomenda por causa de erro de memória.

Quando vale a pena trocar o n8n auto-hospedado pelo n8n Cloud?

O n8n Community auto-hospedado é gratuito e tem execuções ilimitadas, então financeiramente ele já ganha de qualquer plano pago. O n8n Cloud Starter custa €20 por mês com 2.500 execuções mensais, e desde abril de 2026 todos os planos têm workflows ativos ilimitados, então a cobrança fica só nas execuções. Ele faz sentido quando o custo que você quer eliminar não é o token, é o trabalho de manter a VPS.

Ainda vêm mais mudanças de preço da Meta pela frente?

Sim, já existem atualizações de preço anunciadas para Meta Business Agent, mensagens de serviço e mensagens de utilidade, previstas para 1 de agosto de 2026 e 1 de outubro de 2026. Isso pode alterar as tarifas que aparecem nesse post, então vale conferir a página oficial de preços antes de fechar sua conta. Por enquanto os valores válidos são os que já estão na tabela: serviço gratuito na janela de 24 horas, utilidade e autenticação a US$ 0,0068 e marketing a US$ 0,0625.




Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares