Claude 3 Opus era mais caro que o Opus de hoje? O que mudou no preço por token

comparação de preço por token do Claude 3 Opus até o Opus atual
Resposta rápida

Se você bateu numa comparação dizendo que o Opus custa 75 dólares por milhão de tokens de saída, ela está falando do Claude 3 Opus, da geração antiga. Aquele patamar de 15 dólares de entrada e 75 de saída atravessou gerações e só caiu com o Opus 4.5, que cortou para 5 e 25 dólares por 1M tokens. O Opus 5, atual desde 24 de julho de 2026, mantém os mesmos 5 e 25. Ou seja: o nome continua igual, a tabela não. Quem orça API com número velho superestima a conta em cerca de 3x na saída

Fala aí, beleza? Tem comparativo de preço de IA circulando desde 2024 que ainda trata o Opus como o modelo mais caro da praça, e esse texto segue sendo copiado como se fosse a tabela de hoje

O problema é que o nome Opus foi reaproveitado geração após geração, mas o preço por token não ficou parado

Quem pega um número antigo e joga numa planilha de custo de API acaba orçando um modelo que não existe mais desse jeito

Então bora colocar as gerações lado a lado e ver onde exatamente a conta mudou, beleza? 🙂

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 116 aulas
  • 4 projetos
  • 9h 23min

Preço por milhão de tokens: Claude 3 Opus x Opus 4.1 x Opus 4.5 x Opus 5

Modelo Entrada (1M tokens) Saída (1M tokens)
Claude 3 Opus US$ 15 US$ 75
Claude Opus 4.1 US$ 15 US$ 75
Claude Opus 4.5 US$ 5 US$ 25
Claude Opus 5 US$ 5 US$ 25

Repara numa coisa: as duas primeiras linhas são idênticas

O patamar de 15 e 75 dólares não é uma peculiaridade da geração 3, ele atravessou o tempo inteiro até o Opus 4.1

A quebra acontece de uma linha pra outra, no 4.5, e ali o número cai pra um terço e fica

O que mudou entre uma geração e outra do Opus

A linha do tempo do preço é mais simples do que a linha do tempo dos modelos

A geração 3 chegou cobrando US$ 15 por milhão de tokens de entrada e US$ 75 por milhão de saída, número que aparece tanto no pricepertoken quanto na página do modelo no Artificial Analysis

Depois veio o Opus 4.1 e manteve exatamente o mesmo patamar: 15 de entrada, 75 de saída

A virada foi no Claude Opus 4.5, que foi lançado cortando o preço por token pra US$ 5 de entrada e US$ 25 de saída, uma redução de cerca de dois terços em relação ao 4.1

E aí o patamar novo virou o normal: o Claude Opus 5, anunciado em 24 de julho de 2026, cobra os mesmos US$ 5 e US$ 25 por milhão de tokens

Ou seja, teve DOIS regimes de preço na história do Opus, não quatro

Um longo período em 15/75 e um corte único que colou no 4.5 e ficou de pé desde então

Por que comparativo de preço antigo não serve mais de referência

Aqui é onde o bolso sente

Se o texto que você leu diz "o Opus custa 75 dólares por milhão de tokens de saída", ele está descrevendo a geração antiga, não o modelo atual

Na prática, um orçamento feito com aquele número superestima o custo de saída em cerca de 3x, porque hoje o valor é 25

E o erro é fácil de cometer justamente porque o nome não muda: "Opus" em 2024 e "Opus" agora são a mesma palavra apontando pra tabelas diferentes

Como se proteger disso? Duas checagens antes de aceitar qualquer número:

  1. Olhe a geração exata, não o nome. "Opus" sozinho não diz nada. O que decide o preço é o 3, o 4.1, o 4.5 ou o 5 colado no nome
  2. Olhe a data do material. Preço de IA envelhece rápido, e um comparativo que não tem data é um comparativo que você não consegue validar

O mesmo cuidado vale pra qualquer conta de ferramenta em cima desses modelos, tipo o preço do Claude Code em 2026, que segue outra lógica de cobrança

Tome cuidado com print de tabela sem fonte também: é o formato que mais sobrevive desatualizado nas redes 😀

Como pagar menos que a tabela cheia do Opus 5

Os 5 e 25 dólares são o preço de lista, e quase ninguém precisa pagar exatamente isso o tempo todo

Existem mecanismos documentados que mexem no custo real:

  • Cache hit: ler do cache de prompt custa US$ 0,50 por milhão de tokens, ou seja, 10% do preço do token de entrada normal
  • Cache write: escrever no cache sai por US$ 6,25 por milhão no cache de 5 minutos e US$ 10 por milhão no cache de 1 hora
  • Message Batches API: processamento assíncrono com 50% de desconto sobre a tabela padrão, tanto na entrada quanto na saída, com resultados em até 24 horas
  • Inferência restrita aos EUA: aqui o movimento é pra cima, custa 1,1x o preço de entrada e de saída

Se você conhece cache de aplicação web, a lógica do cache de prompt é bem parecida: você paga um pouco mais caro pra gravar e paga bem mais barato toda vez que reaproveita

O desenho ideal é aquele em que a parte estável do prompt (instruções, contexto do projeto, documentação) entra no cache e só o pedido do turno vai como entrada nova

Tem ainda uma alavanca que não é de tabela, é de comportamento: o Opus 5 permite ajustar o esforço de raciocínio por turno, incluindo um modo xhigh

Mais esforço significa mais tokens de raciocínio, e tokens de raciocínio custam dinheiro

Então tratar o effort como escolha por tarefa, e não como configuração fixa no topo, é decisão de custo

O Claude 3 Opus ainda existe? O que a aposentadoria mudou

Ele foi oficialmente aposentado em 5 de janeiro de 2026, sendo o primeiro modelo da Anthropic a passar pelo processo completo de aposentadoria

Mas aposentado não virou desligado no sentido bruto

Ele segue acessível no claude.ai pra todos os usuários de planos pagos, e continua disponível na API mediante solicitação

E o porquê? A própria Anthropic explicou nas notas sobre a depreciação do Opus 3: o custo de manter um modelo servido escala aproximadamente de forma linear por modelo

Cada modelo velho que fica no ar é mais uma conta rodando em paralelo, e isso limita quantos dá pra manter

A empresa também deixou claro que não se comprometeu a repetir esse tratamento com todo modelo futuro

Então, se alguém te disser que o modelo simplesmente sumiu do mapa, não é bem assim: ele continua ali, só que fora do caminho padrão 😛

Vale usar o Opus atual no lugar do Claude 3 Opus?

Pelo lado do bolso não existe dilema

O Opus 5 custa um terço do preço por token da geração 3 na entrada e na saída, e ainda vem com janela de contexto de 1 milhão de tokens e limite de 128 mil tokens de saída

Pagar mais caro pra rodar o modelo mais antigo não fecha em nenhuma conta de API

O caso em que faz sentido continuar na geração 3 é outro: dependência de comportamento específico daquele modelo, avaliação histórica, curiosidade

Não é decisão de custo, é decisão de compatibilidade

E pra quem não paga por token, a régua muda: o Opus 5 é o modelo padrão do plano Claude Max e o modelo mais forte disponível no Claude Pro

Nessa situação a pergunta deixa de ser "quanto custa o milhão de tokens" e vira "qual tarefa merece o modelo mais pesado", que é o mesmo raciocínio de quando o Fable 5 compensa numa demanda mais simples

Conclusão

Recapitulando: o Claude 3 Opus custava US$ 15 de entrada e US$ 75 de saída por milhão de tokens, o Opus 4.1 manteve esse mesmo patamar, o Opus 4.5 cortou pra US$ 5 e US$ 25, e o Opus 5 seguiu nesse valor

O hábito que fica é simples: antes de aceitar qualquer preço de modelo, cheque a GERAÇÃO exata e a data do material

Nome de modelo é reaproveitado, tabela de preço não

O próximo passo prático é refazer a conta do seu volume mensal com 5 e 25 no lugar dos números antigos

Se depois disso a conta ainda apertar, olha primeiro pro cache de prompt e pra Message Batches API antes de trocar de modelo por causa de custo, porque muita economia mora ali e não na troca

até o próximo post! =)

Perguntas frequentes

Quanto custava o Claude 3 Opus por token na API?

O preço de lista era US$ 15 por milhão de tokens de entrada e US$ 75 por milhão de tokens de saída. Esse número aparece registrado no Artificial Analysis e valeu para toda a geração 3.

O Claude 3 Opus e o Claude Opus 4.1 tinham o mesmo preço?

Sim, os dois praticavam exatamente US$ 15 de entrada e US$ 75 de saída por milhão de tokens. O corte de preço só chegou na geração seguinte, com o Opus 4.5.

Dá pra usar o Claude 3 Opus ainda hoje mesmo depois da aposentadoria?

Dá, mas com restrição. Ele segue acessível no claude.ai para todos os usuários de planos pagos e continua disponível na API, só que mediante solicitação, já que foi aposentado oficialmente em 5 de janeiro de 2026.

Qual é a diferença de preço entre o Opus 4.5 e o Opus 5?

Não tem diferença. Os dois cobram US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, o mesmo patamar aberto pelo Opus 4.5.

A Message Batches API funciona com o Claude Opus 5?

Funciona, e é uma das formas de pagar menos que o preço de lista. O processamento é assíncrono, com 50% de desconto sobre a tabela padrão de entrada e saída, e os resultados saem em até 24 horas.

Existe algum caso em que o Claude Opus 5 fica mais caro que o preço padrão?

Existe, quando a inferência é restrita aos Estados Unidos. Nesse modo, o custo sobe para 1,1x o preço padrão de entrada e de saída, o único mecanismo da tabela que aumenta o valor em vez de reduzir.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares