O que é o Claude Opus 5.5 e o que muda em relação ao Opus 5?

comparativo mostrando o que muda no Claude Opus 5.5 em relação ao Opus 5
Resposta rápida

O Claude Opus 5.5 é o primeiro modelo da família Claude 5.5, lançado pela Anthropic em 22 de setembro de 2026 e posicionado para codificação agêntica de longa duração e trabalho de conhecimento. Ele custa US$ 4 por milhão de tokens de entrada e US$ 20 de saída, 20% menos que o Opus 5, com cache read a US$ 0,20 por milhão (60% menos) e saída mais de 30% mais rápida. Em cargas típicas, sai cerca de 40% mais barato para rodar, porque também usa menos tokens por tarefa. O fast mode existe, mas está em research preview.

Fala aí, beleza? A Anthropic acabou de abrir uma família nova de modelos, e o primeiro da fila é o Claude Opus 5.5

O recado central é simples: mais barato, mais rápido e focado em agente que roda por horas sem alguém segurando a mão

Neste post eu vou destrinchar o que é esse modelo, quanto ele custa, o que muda de verdade frente ao Opus 5, como funciona o tal do fast mode e o que os benchmarks divulgados dizem. Bora?

O lançamento e o posicionamento da família Claude 5.5

O Claude Opus 5.5 foi lançado em 22 de setembro de 2026 e chega como o primeiro modelo da família Claude 5.5

O posicionamento oficial da Anthropic é bem específico: ele foi construído para codificação agêntica de longa duração (long-running agentic coding) e para trabalho de conhecimento

Traduzindo: não é o modelo pra responder uma pergunta rápida e tchau. É o modelo pra você largar rodando uma tarefa grande, com várias etapas, e voltar depois

E tem um detalhe que muda o jogo do posicionamento interno da casa: segundo reportagem do the-decoder, o Opus 5.5 desempenha no nível do Claude Fable 5.1 na maioria das tarefas. Ou seja, nível de topo de linha em um modelo que custa menos pra operar

Sobre onde rodar, ele está disponível em todas as plataformas da Anthropic e também nas nuvens da Amazon, do Google e da Microsoft

E olha, isso aqui é só o começo: a Anthropic já avisou que Claude Sonnet 5.5 e Claude Haiku 5.5 chegam nas próximas semanas, com muitas das mesmas melhorias de desempenho, eficiência e segurança…

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 120 aulas
  • 4 projetos
  • 9h 45min

Claude Opus 5.5 vs Opus 5: o que muda na prática

Antes de entrar na explicação, se liga na comparação lado a lado. É aqui que a diferença fica visível de cara:

Item Claude Opus 5.5 Opus 5 Variação
Entrada (por milhão de tokens) US$ 4 US$ 5 20% mais barato
Saída (por milhão de tokens) US$ 20 US$ 25 20% mais barato
Cache read (por milhão de tokens) US$ 0,20 base de comparação 60% mais barato
Fast mode (entrada / saída) US$ 8 / US$ 40 US$ 10 / US$ 50 20% mais barato
Velocidade de geração de saída mais de 30% mais rápida base de comparação +30%
Custo total em cargas típicas cerca de 40% menos base de comparação -40%

Repara numa coisa: a queda de preço por token é de 20%, mas o custo total em cargas típicas cai uns 40%

Esses dois números não se contradizem: além de cobrar menos por token, o modelo usa menos tokens por tarefa

Custo e velocidade: por que a conta fica 40% menor

A economia vem de duas frentes somadas, não de uma só

A primeira é óbvia: o preço por token caiu 20% na entrada e na saída

A segunda é a que pouca gente olha: o modelo usa menos tokens por tarefa. Menos idas e vindas, menos texto cuspido à toa, menos retrabalho

É como trocar um carro por outro que gasta menos por litro E ainda por cima pega a rota mais curta. O ganho multiplica

A Anthropic conta um caso de um testador antecipado que auditou e corrigiu uma base de código de 200 mil linhas em menos de três horas

O Opus 5, na mesma tarefa, levou mais de 20 horas e consumiu 2,5x mais tokens

Tem outro dado que eu achei MUITO interessante, publicado pelo thenewstack: em revisão de código, no menor nível de effort, o Opus 5.5 detectou 72% dos bugs conhecidos

O Opus 5, rodando em high effort, ficou em 56%

E com menos falsos alarmes e menos saída gerada. Isso é o tipo de coisa que aparece direto na fatura no fim do mês, beleza?

Fast mode: preço, onde funciona e como ligar no Claude Code

O fast mode é um modo separado, pago à parte, pra quando você quer resposta saindo o mais rápido possível

No Opus 5.5 ele custa US$ 8 por milhão de tokens de entrada e US$ 40 por milhão de saída, entregando até 2,5x mais tokens de saída por segundo

Pra comparar: no Opus 5 e no Opus 4.8, o fast mode sai por US$ 10 de entrada e US$ 50 de saída

Agora o aviso importante, e é um aviso grande: o fast mode está em research preview

Para o Opus 5.5 especificamente, ele está disponível apenas na Claude API. Não está em Amazon Bedrock, nem na Claude Platform na AWS, nem no Google Cloud, nem no Microsoft Foundry

Então se o teu fluxo mora numa nuvem dessas, esse recurso não te alcança por enquanto

Passo a passo no Claude Code:

  1. Cheque a versão do Claude Code. O fast mode exige v2.1.271 ou superior. Erro comum deste passo: tentar ativar numa versão antiga e achar que o comando não existe, quando na verdade é a versão que está atrás
  1. Em sessões na nuvem, digite /fast on. Vale só pra aquela sessão. Erro comum: achar que ficou ligado pra sempre e se perder depois
  1. No CLI, defina "fastMode": true no arquivo de settings do usuário. Fica assim:
{
  "fastMode": true
}
  1. Confira o acesso do teu plano. O fast mode no Claude Code está disponível pra usuários em planos de assinatura (Pro, Max, Team, Enterprise) e no Claude Console
  1. Se você está em Team ou Enterprise, fale com o Owner. Nesses casos um Owner precisa habilitar antes, e organizações do Console precisam ter o acesso provisionado. É um detalhe parecido com outras diferenças entre conta individual e plano empresarial do Claude, onde a permissão passa por quem administra
  1. Ative no início da sessão, não no meio. A recomendação oficial é essa mesma: pra melhor eficiência de custo, liga no começo em vez de trocar no meio da conversa

Tome cuidado com o passo 6. Trocar de modo no meio da conversa é o clássico jeito de pagar mais caro achando que está economizando

Especificações técnicas que importam para quem integra

Se tu vai plugar o modelo em algum lugar, esses são os números que interessam:

  • Identificador na API: claude-opus-5-5
  • Janela de contexto: 1 milhão de tokens, que é o valor padrão e também o máximo
  • Adaptive thinking: sempre ligado. O parâmetro effort controla a profundidade do raciocínio, e o padrão nesse modelo é medium
  • Saída em lote: até 300 mil tokens de saída na Message Batches API, usando o header beta output-300k-2026-03-24
  • Prompt cacheável: mínimo de 512 tokens

Esse detalhe do effort merece atenção. Como o padrão é medium, subir pra um nível maior sem necessidade é dinheiro indo embora

E lembra do dado de revisão de código lá em cima? No menor effort o modelo já bateu o Opus 5 em high effort. Então começar baixo e só subir se precisar é a ordem mais sensata

Benchmarks divulgados: Opus 5.5 frente ao GPT-6 Astra

A Anthropic divulgou uma comparação direta com o GPT-6 Astra. Os números, compilados pelo officechai:

Benchmark Opus 5.5 GPT-6 Astra
Terminal-Bench 4.0 66,4% 57,9%
FrontierCode v1.1 54,4% 53,3%
GDPval-AA v2.1 (Elo) 1846 1542
Humanity’s Last Exam (com ferramentas) 67,7% 57,2%
Terminal-Bench-Science 58,7% 64,6%

Agora a parte honesta, que eu acho zoado omitir: o Astra fica à frente em Terminal-Bench-Science, com 64,6% contra 58,7% do Opus 5.5

Não é varrida geral, é vitória em alguns pontos e derrota em outros. Como sempre, benchmark é indício, não sentença =)

Segurança, comportamento e o roteamento silencioso

Tem um ponto operacional aqui que pode te morder em produção, então fica ligado

Primeiro os dados bons: a Anthropic afirma que o Opus 5.5 é 85% menos propenso que o Opus 5 ou que o Mythos 5.1 (um modelo diferente do Fable 5.1 que citei lá no começo) a tentar burlar os limites definidos

E que ele é o modelo com melhor desempenho na auditoria comportamental automatizada da empresa até hoje

Antes do lançamento, o modelo passou por avaliadores externos, incluindo o METR

Agora a parte que todo mundo que monta agente precisa saber: segundo o thenewstack, classificadores de segurança podem redirecionar silenciosamente requisições individuais dentro de um fluxo agêntico multi-turno para modelos anteriores, tipo Opus 4.8 ou Opus 5, em vez do Opus 5.5

Silenciosamente, entendeu? Você acha que tá rodando tudo no 5.5 e uma requisição no meio do caminho foi atendida por outro modelo

Em fluxo agêntico longo, isso é uma variável real de comportamento e de resultado. Vale ter no radar antes de culpar o teu prompt

Para quem o Claude Opus 5.5 faz diferença agora

Nem todo mundo precisa correr pro modelo mais caro da casa. Então vamos aos cenários onde esse lançamento realmente muda alguma coisa:

  • Agentes de longa duração. É literalmente o posicionamento oficial do modelo. Se a tua tarefa roda por horas, o combo de 30% mais velocidade e menos tokens por tarefa aparece rápido no resultado
  • Auditoria e refatoração de base grande. O caso do testador antecipado com 200 mil linhas em menos de três horas é exatamente esse perfil
  • Revisão de código com orçamento apertado. Rodar em effort baixo e ainda pegar 72% dos bugs conhecidos, com menos falsos alarmes, é uma troca muito boa
  • Trabalho de conhecimento com contexto extenso. Com 1 milhão de tokens de janela, dá pra jogar material grande dentro da conversa. Se o teu interesse é mais nesse lado do que em código puro, vale entender também qual modelo roda no Claude Cowork antes de escolher onde trabalhar

E quem não se encaixa em nada disso? Provavelmente compensa esperar

Sonnet 5.5 e Haiku 5.5 chegam nas próximas semanas com muitas das mesmas melhorias, e historicamente esses dois são a escolha de volume

Vale migrar do Opus 5 para o Opus 5.5?

Se você já está no Opus 5, a matemática é bem direta: você ganha dos dois lados

Paga 20% menos por token, gasta menos tokens por tarefa (cerca de 40% menos no total em cargas típicas) e ainda recebe a saída mais de 30% mais rápido

Não é um daqueles upgrades onde você troca custo por qualidade. Aqui os dois andam junto

Porém, duas ressalvas honestas

A primeira: o fast mode ainda é research preview e, no Opus 5.5, só existe na Claude API. Se o teu plano era contar com ele dentro de Bedrock, Google Cloud ou Microsoft Foundry, esse pedaço não está de pé

A segunda: o roteamento por classificadores de segurança é uma variável de verdade em fluxo agêntico multi-turno. Não invalida nada, mas entra na conta de quem depende de comportamento previsível

Fora isso, é difícil defender ficar no Opus 5 hoje

Conclusão

O Claude Opus 5.5 abre a família 5.5 fazendo o que todo lançamento deveria fazer: entregar mais performance custando menos

Desempenho no nível do Fable 5.1 na maioria das tarefas, cerca de 40% menos custo em cargas típicas, saída mais de 30% mais rápida e uma janela de 1 milhão de tokens

Próximos passos práticos, na ordem:

  1. Confira se o teu Claude Code está em v2.1.271 ou superior, senão o fast mode nem aparece pra você
  2. Antes de sair subindo o effort acima do padrão medium, teste no nível baixo. Os dados de revisão de código sugerem que dá pra economizar bastante aí
  3. Fique de olho na chegada do Sonnet 5.5 e do Haiku 5.5, porque pra muita carga de volume eles é que vão ser a resposta certa

Até o próximo post! 😀

Perguntas frequentes

Quanto custa o Claude Opus 5.5 por token na API?

US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída. É 20% mais barato que o Opus 5, que cobra US$ 5 de entrada e US$ 25 de saída. O cache read sai por US$ 0,20 por milhão de tokens, 60% menos que o antecessor.

O fast mode do Claude Opus 5.5 funciona no Google Cloud ou na AWS?

Não. O fast mode está em research preview e, para o Opus 5.5, disponível apenas na Claude API. Não está em Amazon Bedrock, Claude Platform na AWS, Google Cloud ou Microsoft Foundry.

Qual a diferença de velocidade entre o Claude Opus 5.5 e o Opus 5?

O Opus 5.5 gera saída mais de 30% mais rápido que o Opus 5. Com o fast mode ativado ele entrega até 2,5x mais tokens de saída por segundo, mas esse modo custa à parte e só roda na Claude API.

O Claude Opus 5.5 supera o GPT-6 Astra nos benchmarks?

Na maioria sim: 66,4% contra 57,9% no Terminal-Bench 4.0 e 67,7% contra 57,2% no Humanity’s Last Exam com ferramentas, por exemplo. O Astra fica à frente no Terminal-Bench-Science, com 64,6% contra 58,7% do Opus 5.5.

Qual versão do Claude Code é necessária pra ativar o fast mode?

É preciso ter o Claude Code v2.1.271 ou superior. Em sessões na nuvem o comando é /fast on, válido só pra aquela sessão; no CLI se define "fastMode": true no arquivo de settings do usuário.

O Claude Opus 5.5 é mais seguro que o Opus 5?

Segundo a Anthropic, sim: ele é 85% menos propenso que o Opus 5 ou o Mythos 5.1 a tentar burlar os limites definidos. É também o modelo com melhor desempenho na auditoria comportamental automatizada da empresa até hoje, e foi testado antes do lançamento por avaliadores externos, incluindo o METR.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares