Grok 4.6 Fast vale o dobro do preço?

comparação de preço entre Grok 4.6 e Grok 4.6 Fast por milhão de tokens
Resposta rápida

O Grok 4.6 Fast é a variante rápida do modelo de fronteira da xAI, e a página oficial descreve ela custando o dobro do padrão: o Grok 4.6 normal sai por US$ 2,00 por milhão de tokens de entrada e US$ 6,00 de saída, então a versão rápida fica em US$ 4,00 e US$ 12,00 na dobra direta. O que o dobro compra é velocidade, não inteligência: os 61 pontos no Artificial Analysis Intelligence Index já vêm no padrão. Vale quando tem humano esperando na tela, não quando o trabalho roda em background

Pagar o dobro por um modelo que pontua igual só faz sentido se o tempo de resposta valer dinheiro no teu caso

A xAI lançou o Grok 4.6 em agosto de 2026, sucessor do Grok 4.5, com foco declarado em agentes de longa duração e tarefas interativas e visuais mais ambiciosas: pesquisar um tema, analisar informação, trabalhar através de uma base de código, transformar uma ideia em aplicação

E na mesma página oficial aparece a pegadinha da decisão: existe uma variante rápida do modelo, e ela custa o dobro

Então a pergunta do post é essa, bem direta: em que situação o dobro se paga, e em que situação o padrão resolve exatamente igual? 🙂

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 114 aulas
  • 4 projetos
  • 9h 18min

Grok 4.6 padrão x variante rápida: preço lado a lado

Primeiro os números, porque é deles que sai a conta

Modelo Entrada (por milhão de tokens) Saída (por milhão de tokens)
Grok 4.6 padrão US$ 2,00 US$ 6,00
Grok 4.6 variante rápida US$ 4,00 US$ 12,00
Grok 4.5 (geração anterior) US$ 2,00 US$ 6,00

Repara na terceira linha, que é a parte mais massa da tabela

O Grok 4.6 padrão cobra o MESMO preço do Grok 4.5, e ainda assim marca 61 pontos no Artificial Analysis Intelligence Index contra 56 pontos do Grok 4.5 High

Ou seja: o ganho de índice veio de graça na geração nova, sem mexer no preço de tabela

Agora, a honestidade que esse tipo de post costuma pular: não tem número oficial de latência publicado aqui

O que a xAI diz da variante rápida é o preço dobrado, e só

Quanto ela é mais rápida em tokens por segundo, e o que muda tecnicamente por dentro dela, eu não vou chutar

Os números de velocidade que circulam por aí são de outras versões do Grok, e botar eles aqui como se fossem do 4.6 seria enganar você

Quando a latência menor justifica pagar o dobro

O jeito de decidir isso não é olhar o preço, é olhar quem está esperando a resposta

Se tem um ser humano parado na frente da tela vendo o cursor piscar, latência é experiência de produto, e experiência de produto é receita

Os casos onde velocidade vira dinheiro:

  • Interface conversacional: chat com usuário final, suporte, assistente dentro do teu app, qualquer coisa em que a pessoa julga o produto pelo tempo até a primeira palavra aparecer
  • Edição assistida dentro do editor: o Grok 4.6 está no Cursor, e ali um segundo a mais em cada sugestão estraga o fluxo de quem está codando
  • Demo ao vivo: apresentação pra cliente, aula, gravação, onde silêncio de espera é constrangedor haha
  • Fluxos interativos em geral: qualquer laço em que o usuário responde, o modelo responde, e assim vai

Agora o contraponto, que é onde a maioria dos devs realmente vive

Se ninguém está olhando, latência não vale nada

  • Agente de longa duração: justamente o cenário que a xAI destaca pro 4.6, tarefa multi-etapas que roda sozinha por um tempão
  • Pipeline em lote: processar mil itens de madrugada, classificar, resumir, enriquecer
  • Geração noturna: o job sobe às 3h e você lê o resultado no café
  • Análise de base de código: o modelo varre repositório inteiro e devolve o mapa, e ninguém cronometra isso

Nesses quatro, pagar US$ 12,00 de saída por milhão em vez de US$ 6,00 é literalmente comprar pressa pra uma máquina que não tem pressa 😛

Veredito: para quem o Grok 4.6 Fast compensa

O veredito honesto muda por perfil, então vou separar

Dev que roda volume alto em background: fica no padrão

Sem discussão

Teu custo dobra e teu resultado é o mesmo, porque o salto de qualidade não está na variante rápida, está na geração: os 61 pontos do Artificial Analysis Intelligence Index contra 56 do Grok 4.5 High já vêm no Grok 4.6 padrão, pelo preço da geração anterior

Produto com usuário final esperando resposta: pode testar e MEDIR

Aqui a variante rápida entra como hipótese, não como escolha óbvia

Testa, mede o tempo real na tua tarefa, compara com o custo mensal que a dobra do preço gera, e decide com dado na mão

A regra que eu levaria pra qualquer time: o dobro do preço não compra inteligência extra

Compra tempo

Se tempo não é gargalo no teu caso, você está só doando margem

E se o teu contato com o modelo ainda é pelo app e não pela API, dá pra conhecer o comportamento dele antes de gastar: eu já expliquei aqui como usar o Grok sem pagar e a ideia serve bem como porta de entrada

Como testar os dois no seu fluxo antes de decidir

Decidir por preço de tabela é o erro clássico

O certo é rodar a MESMA tarefa real nas duas variantes e olhar tempo contra custo

  1. Abre a documentação oficial do modelo, em docs.x.ai/developers/grok-4-6, e confere ali os identificadores e parâmetros atuais. O erro comum deste passo: copiar nome de modelo de post de blog ou de agregador de notícia. Nome de modelo muda, e chamada com identificador errado só devolve erro
  2. Escolhe o acesso que já faz parte do teu fluxo. O Grok 4.6 está disponível na API da xAI, no Cursor e listado no OpenRouter como x-ai/grok-4.6
  3. Separa uma tarefa real, não um "oi tudo bem". Prompt de brinquedo não mede nada: usa o teu prompt de produção, com o teu tamanho de contexto e a tua saída esperada
  4. Roda a mesma tarefa nas duas variantes, várias vezes, e anota tempo total e tokens de entrada e saída de cada rodada
  5. Faz a conta com os teus números. Multiplica o teu volume mensal de tokens pelos dois preços e vê quanto a dobra custa por mês de verdade. O erro comum deste passo: estimar volume no olho. Puxa o consumo real do teu painel
  6. Compara tempo contra custo e decide. Se a diferença de segundos não muda a percepção de quem usa, a resposta já veio

Uma observação de transparência: se a variante rápida mantém o mesmo preço dobrado em todos os revendedores, ou se isso vale só na API direta da xAI, eu não vi confirmado

Então confere o preço no lugar onde VOCÊ vai consumir, não no lugar onde eu escrevi

Vídeo: alternativas para programar com IA sem estourar o orçamento

Esse papo todo é sobre custo, e custo tem mais de um caminho

Pra começar do zero nesse assunto de programar com IA gastando pouco, esse vídeo do canal mostra um caminho alternativo pra quem não quer pagar mensalidade

Conclusão

A decisão cabe em uma linha: padrão por padrão, variante rápida por exceção medida

O Grok 4.6 padrão custa US$ 2,00 por milhão de entrada e US$ 6,00 de saída, o mesmo do Grok 4.5, e já entrega os 61 pontos do Artificial Analysis Intelligence Index

A variante rápida cobra o dobro disso e entrega velocidade, não pontuação

Seu próximo passo é bem concreto: abre a documentação oficial, roda a mesma tarefa nas duas variantes e compara tempo contra custo com os teus números

Sem esse teste, qualquer escolha aqui é chute com cartão de crédito na mão 😀

até o próximo post!

Perguntas frequentes

Quanto custa o Grok 4.6 Fast em relação ao Grok 4.6 padrão?

O Grok 4.6 padrão cobra US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de saída. A variante rápida custa o dobro: US$ 4,00 de entrada e US$ 12,00 de saída por milhão de tokens.

O Grok 4.6 Fast é mais inteligente que o Grok 4.6 padrão?

Não há indicação disso na documentação oficial. O ganho de inteligência está na geração do modelo, não na variante: o Grok 4.6 padrão já marca 61 pontos no Artificial Analysis Intelligence Index, contra 56 do Grok 4.5 High, pelo mesmo preço da geração anterior.

O Grok 4.6 compensa mais que o Grok 4.5 pelo mesmo preço?

Sim, no padrão. O Grok 4.5 custa US$ 2,00/milhão de entrada e US$ 6,00/milhão de saída, exatamente o mesmo valor do Grok 4.6 padrão, que ainda assim sobe de 56 para 61 pontos no Artificial Analysis Intelligence Index.

Onde dá pra usar o Grok 4.6 além da API da xAI?

O modelo está disponível na API da xAI, no Cursor e listado no OpenRouter como x-ai/grok-4.6. A documentação oficial para desenvolvedores fica em docs.x.ai/developers/grok-4-6.

Quando faz sentido pagar o dobro pelo Grok 4.6 Fast?

Quando existe um usuário humano esperando a resposta em tempo real, como chat, suporte ou edição dentro de um editor de código. Em agente de longa duração, pipeline em lote ou processamento noturno, ninguém cronometra a resposta, então o padrão resolve pelo mesmo resultado e metade do custo.

Existe dado oficial sobre a latência do Grok 4.6 Fast?

Não. A documentação oficial confirma a dobra de preço da variante rápida, mas não publica número de latência ou tokens por segundo. A recomendação é medir o tempo de resposta na própria tarefa antes de decidir, em vez de usar números de outras versões do Grok.




Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares