Prompt do GPT-6 Astra funciona igual no Fable 5.1? O que reescrever ao portar

Portar prompt do GPT-6 Astra para o Claude Fable 5.1 não é trocar o endpoint e rezar: os dois se parecem no papel (contexto na casa de 1M, teto de 128K de saída, US$ 10 por milhão de entrada e US$ 50 por milhão de saída) e mesmo assim reagem diferente à mesma instrução. O que costuma quebrar é regra de formatação herdada, exemplos, pedido de raciocínio explícito, texto entre chamadas de ferramenta e o rótulo de effort copiado como se fosse equivalente. Aqui vai o roteiro de adaptação, passo a passo, com regressão e canary antes de liberar.
Fala aí, beleza? Todo mundo já fez isso: pegou o prompt que estava redondinho no GPT-6 Astra, colou no Claude Fable 5.1 e ficou esperando a mesma resposta sair do outro lado
Não sai 🙂
O momento ajuda a confundir: a Anthropic anunciou o Claude Fable 5.1 (e o Mythos 5.1, o mesmo modelo com salvaguardas diferentes, esse só via programa de acesso confiável) em 01/09/2026, e a OpenAI liberou o GPT-6 Astra em preview para parceiros confiáveis em 03/09/2026, com abertura pública para usuários pagantes no dia seguinte, numa versão restrita que recusa certos prompts em áreas como cibersegurança
No papel os dois se encostam demais: contexto na casa de 1M de tokens, teto de 128K de saída, US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída em ambos
Aí bate a sensação de que o prompt é portátil, e não é
O que muda é o que cada um assume quando você NÃO diz nada: formatação, exemplos, quanto texto aparece entre as chamadas de ferramenta, quanto raciocínio ele gasta
Este post é um roteiro de adaptação, não um copiar e colar
GPT-6 Astra e Claude Fable 5.1: o que muda no que o prompt precisa dizer
| Item | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| Identificador na API | gpt-6-astra |
claude-fable-5-1 |
| Onde roda | API da OpenAI, Microsoft Azure e Amazon Bedrock | API da Claude |
| Contexto e saída | 1.050.000 tokens de contexto, máximo de 922.000 de entrada e 128.000 de saída | 1M de tokens de contexto e saída máxima de 128K |
| Controle de esforço | reasoning.effort com low, medium, high, xhigh e max, sem suporte ao esforço none |
effort com os mesmos cinco níveis, sendo high o padrão |
| Formatação padrão | tende a listas, tabelas e Markdown, e a repetir as mesmas expressões entre sessões | formata menos, usa negrito com menos frequência e recorre menos a cabeçalhos, listas e aspas |
| Chamada de ferramentas | exige a Responses API, com web search, file search, image generation, code interpreter, hosted shell, apply patch, skills, computer use, MCP e tool search | emite chamadas paralelas quando o pedido nomeia várias coisas, e a API não define a ordem de execução do lote devolvido |
| Preço de entrada e saída | US$ 10,00 e US$ 50,00 por milhão de tokens | US$ 10 e US$ 50 por milhão de tokens |
| Cache de leitura | US$ 1,00 por milhão de tokens de entrada em cache | US$ 0,25 por milhão de tokens de entrada em cache |
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 114 aulas
- 4 projetos
- 9h 18min
Três pontos ficam de fora da tabela porque não são comparação lado a lado, são característica de um dos dois:
- No Astra dá pra mudar o reasoning effort no meio da conversa com um item de entrada
configuration_update, sem reescrever o prefixo do prompt - No Astra o preço tem multiplicadores: Batch e Flex a 50%, Fast a 2x, e prompts acima de 272K tokens de entrada a 2x nas tarifas de entrada e cache e 1,5x na saída, para a requisição inteira
- No Fable 5.1 o texto voltado ao usuário entre as chamadas de ferramenta é mais escasso, e precisa ser pedido explicitamente
Lendo a tabela: preço de lista de entrada e saída é igual, o teto de saída é igual e o contexto é da mesma ordem, então o custo por token não é o motivo de reescrever nada
O que pede reescrita é o comportamento padrão: formatação invertida entre os dois, texto entre ferramentas que some no Fable 5.1 se você não pedir, e o rótulo de esforço que parece igual porque tem o mesmo nome
O que ter em mãos antes de portar o prompt
Antes de mexer numa vírgula do texto, junta isso aqui:
- O prompt atual isolado do código, num arquivo só dele, sem ficar picotado em concatenação de string espalhada pela aplicação
- Os identificadores certos:
gpt-6-astrade um lado,claude-fable-5-1do outro - O conjunto de ferramentas e a ordem das definições documentados, porque no Astra isso faz parte do prefixo de cache junto com verbosity, configurações de structured output, modelo, reasoning effort e gerenciamento de contexto
- Casos de teste com saída esperada, pra comparar antes e depois em vez de julgar no olho
- Um caminho de rollback testado, não um plano de rollback imaginado 😀
Um detalhe que costuma travar o port logo no começo: no GPT-6 Astra, tool calling exige a Responses API
Se o seu app ainda usa ferramentas via Chat Completions, o guia de migração para Responses vem ANTES de qualquer ajuste de texto, senão você vai debugar prompt achando que o problema é redação
Se o caminho for o inverso, sair do Claude e ir pro Astra, tem um checklist antes de trocar o modelo que cobre a parte de infra do lado de lá
Roteiro para adaptar o prompt do GPT-6 Astra ao Fable 5.1
A lógica é sempre a mesma: o que você escreveu pra CORRIGIR um comportamento do Astra vira ruído (ou vira estrago) no Fable 5.1
Bora ver na prática?
1. Formato: apague a regra anti formatação:
O Astra tende a estruturar tudo com listas, tabelas e Markdown por padrão, então quase todo prompt maduro de Astra tem uma linha brigando com isso
O Fable 5.1 já formata menos por natureza, e a orientação da Anthropic é remover a linguagem anti formatação dos prompts antigos e trocar por uma regra que diga QUANDO a formatação é apropriada
Antes (herdado do Astra):
Não use listas. Não use tabelas. Não use cabeçalhos.
Responda em parágrafos concisos, linguagem simples e voz ativa.
Depois (Fable 5.1):
Use prosa corrida para explicação e justificativa.
Use tabela quando houver comparação de 3 ou mais itens pelos mesmos critérios.
Use lista numerada apenas quando a ordem dos passos importar.
O erro comum deste passo: manter o "não use listas" e ganhar um paredão de prosa justamente onde uma tabela resolveria em 4 linhas
2. Vocabulário e instruções afirmativas:
A OpenAI publicou uma blocklist de expressões a evitar no GPT-6 Astra, com coisas como "Conclusion:", "delve into", "it’s worth noting", "what’s important is", o padrão "This isn’t about X. It’s about Y" e compostos hifenizados inventados
Essa lista é remédio pro tique de UM modelo, então ela não vira automaticamente regra do outro lado
O que dá pra levar junto é a dica de estilo da própria OpenAI: o modelo deve declarar o que está fazendo em vez de listar o que não vai fazer, sem ficar mencionando o que permanece inalterado ou como vai separar os resultados
Antes:
Não escreva "Conclusion:". Não use "delve into".
Não diga o que você não vai mudar.
Depois:
Declare a ação executada e o resultado dela.
Encerre com a decisão tomada, sem seção de fechamento genérica.
O erro comum deste passo: transportar a blocklist inteira e transformar o system prompt num muro de proibições, gastando token de contexto com tique que o outro modelo talvez nem tenha
3. Exemplos: mostre o formato em vez de descrever:
Quando um padrão de saída específico importa, a recomendação da Anthropic é dar ao Claude um exemplo completo
E incluir de 3 a 5 exemplos diversos e relevantes melhora o desempenho, principalmente em tarefas complexas
Se você conhece teste automatizado, é o mesmo espírito: exemplo é o caso concreto, a descrição em prosa é a documentação otimista de como você ACHA que funciona
Siga exatamente o formato abaixo.
<exemplo>
Entrada: ticket #402, cliente relata cobrança duplicada
Decisão: reembolso parcial
Evidência: duas transações com mesmo valor em 12/08
Ação: abrir estorno e responder ao cliente
</exemplo>
O erro comum deste passo: um exemplo só, e todos os casos reais caindo fora dele
4. Raciocínio explícito: peça decisão, não monólogo:
Muito prompt de Astra carrega alguma variação de "explique seu raciocínio passo a passo" grudada desde sempre
No Fable 5.1, a orientação é evitar instruções desnecessárias para expor o raciocínio interno, e quando você precisa de transparência, pedir a decisão, a evidência ou uma justificativa concisa
Antes:
Pense passo a passo e mostre todo o seu raciocínio antes de responder.
Depois:
Antes da resposta final, informe: decisão, evidência que sustenta e uma justificativa em no máximo duas frases.
O erro comum deste passo: confundir transparência com verborragia e pagar saída cara (US$ 50 por milhão de tokens) pra ler o modelo pensando alto
5. Ferramentas: peça o progresso e empurre o batching:
Essa é a que mais assusta quem porta um agente
O Fable 5.1 produz menos texto voltado ao usuário entre tool calls que o Fable 5, a geração anterior, e a orientação é pedir atualizações de progresso explicitamente: quando você quer texto ao usuário, o que cada atualização deve conter e um resumo final
Sobre paralelismo, o modelo normalmente já emite chamadas paralelas quando o pedido nomeia várias coisas a fazer, mas em loops longos de código e uso de computador as chamadas independentes podem precisar de um empurrão explícito de batching no prompt
Antes de cada grupo de ferramentas, escreva uma linha ao usuário com o que vai fazer e por quê.
Agrupe leituras independentes numa mesma rodada de chamadas.
Ao terminar, entregue um resumo final com o que mudou e o que ficou pendente.
O erro comum deste passo: achar que o agente travou porque a interface ficou muda por 40 segundos, quando na real ele só não recebeu instrução pra falar
6. Esforço: refaça a varredura, não copie o rótulo:
Os dois têm cinco níveis com os mesmos nomes (low, medium, high, xhigh e max), o Astra não suporta o esforço none, e no Fable 5.1 o padrão é high
Parece mapeamento 1 pra 1, e não é: a Anthropic recomenda refazer a varredura de effort ao migrar, porque gerações diferentes não mapeiam os mesmos rótulos para a mesma quantidade de raciocínio
Esse mesmo cuidado vale até dentro da mesma família, como no caso dos prompts do Fable 5 no 5.1
Uma diferença operacional que muda arquitetura: no Astra dá pra aumentar ou reduzir o reasoning effort no meio da conversa com um item de entrada configuration_update, sem reescrever o prefixo do prompt, e o novo valor vale até outro configuration_update sobrescrever
Se a sua aplicação depende desse ajuste dinâmico, confira na documentação da Anthropic como fazer isso do lado do Claude antes de assumir que funciona igual
O erro comum deste passo: copiar effort: "max" do Astra por segurança e descobrir a conta no fim do mês
7. Validar: regressão, canary e rollback:
O procedimento que a Anthropic recomenda para a migração é rodar avaliações de regressão contra o Fable 5, liberar em canary para uma fatia controlada do tráfego, monitorar acurácia das tool calls e uso de tokens, e preservar um caminho de rollback testado
A mesma disciplina serve pro port vindo do Astra: sem baseline, você não tem como saber se o prompt novo melhorou ou só mudou
O erro comum deste passo: validar em 3 exemplos escolhidos a dedo, aprovar e mandar pra 100% do tráfego
Sintomas de prompt mal portado (e o que corrigir)
A resposta virou prosa crua (ou lista demais):
Causa provável: regra de formatação herdada do modelo errado, aquele "não use listas" que existia só pra segurar o Astra
Correção: trocar a proibição por uma regra que diga quando formatar, já que o Fable 5.1 formata menos por padrão e usa negrito com menos frequência
Prevenção: tratar a seção de formato como código específico do modelo, não como texto universal
Sumiram as mensagens de progresso durante a sequência de ferramentas:
Causa provável: o Fable 5.1 produz menos texto voltado ao usuário entre tool calls que o Fable 5
Correção: pedir as atualizações explicitamente, dizendo quando você quer texto ao usuário, o que cada atualização contém e o resumo final
Prevenção: incluir "mensagem de progresso" nos casos de teste, e não só a saída final
As ferramentas rodam fora de ordem ou pisam umas nas outras:
Causa provável: quando o Claude devolve várias tool calls no mesmo turno, a API não define a ordem de execução, quem decide é o seu código
Correção: executar operações independentes e de leitura em paralelo, e mandar pra fila sequencial as ferramentas com efeito colateral ou estado compartilhado
Prevenção: marcar cada ferramenta do seu catálogo como leitura ou escrita antes de subir o agente, e não depois do primeiro susto com os rm -rf da vida
Custo ou latência estourou depois do port:
Causa provável: cache quebrado, porque no Astra mudar o conjunto de ferramentas permitido é um risco comum, e verbosity, definições de ferramenta e sua ordem, structured output, modelo, reasoning effort e gerenciamento de contexto entram no prefixo de cache
Correção: congelar a ordem das definições de ferramenta e revisar o effort escolhido, lembrando que a leitura de cache é US$ 1,00 por milhão no Astra e US$ 0,25 por milhão no Fable 5.1
Prevenção: no Astra, ficar de olho no tamanho do prompt, porque acima de 272K tokens de entrada a requisição INTEIRA passa a ser cobrada a 2x nas tarifas de entrada e cache e 1,5x na saída
Conclusão
Portar prompt é reescrever intenção, não trocar endpoint
O texto que estava afinado pro GPT-6 Astra carrega correções que o Claude Fable 5.1 não precisa, e deixa de dizer coisas que o Fable 5.1 espera ouvir, tipo quando falar com o usuário no meio de uma sequência de ferramentas
Próximo passo, bem pequeno: pega UM prompt de produção, aplica os ajustes de formato, ferramentas e effort, roda a regressão contra a versão anterior comparando saída, acurácia das tool calls e uso de tokens, e só então libera em canary numa fatia controlada, com rollback pronto
E uma nota honesta: os dois modelos são muito recentes, anunciados na primeira semana de setembro de 2026, então qualquer conclusão sobre comportamento em produção merece a SUA medição antes de virar decisão definitiva
Até o próximo post!
Perguntas frequentes
Portar o prompt do GPT-6 Astra pro Claude Fable 5.1 muda o custo por token?
Não pelo preço de lista: os dois cobram US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída. A diferença fica no cache de leitura, US$ 1,00 por milhão no Astra contra US$ 0,25 por milhão no Fable 5.1, e nos multiplicadores por modo e tamanho de prompt que só existem no Astra.
Por que pedir effort high no GPT-6 Astra e no Claude Fable 5.1 não dá o mesmo resultado?
Os dois têm um parâmetro com os mesmos cinco rótulos, low, medium, high, xhigh e max, e high é o padrão no Fable 5.1. Mas a Anthropic recomenda refazer a varredura de effort ao migrar, porque gerações diferentes de modelo não mapeiam o mesmo rótulo para a mesma quantidade de raciocínio.
Preciso migrar para a Responses API antes de adaptar o prompt do GPT-6 Astra?
Sim, se o prompt usa chamada de ferramentas. O tool calling no GPT-6 Astra exige a Responses API, então quem ainda está em Chat Completions precisa seguir o guia de migração antes de mexer no texto do prompt, senão o problema parece ser de redação e não é.
Dá pra trocar o nível de raciocínio no meio da conversa sem perder o cache de prompt?
No GPT-6 Astra sim: um item de entrada configuration_update ajusta o reasoning effort sem reescrever o prefixo do prompt, e o valor novo fica valendo até outro configuration_update mudar de novo. No Claude Fable 5.1, o controle de raciocínio é o parâmetro effort, com cinco níveis e high como padrão, e a recomendação da Anthropic é refazer a varredura desses níveis ao migrar.
Qual identificador de modelo usar na API ao portar o prompt?
Na API da OpenAI o modelo é gpt-6-astra, e na API da Claude é claude-fable-5-1. Trocar o conjunto de ferramentas ou a ordem das definições no Astra quebra o cache de prompt, então vale documentar isso junto com o identificador antes de portar.
O prompt do Claude Fable 5.1 funciona igual no Claude Mythos 5.1?
Os dois são o mesmo modelo, então a base do prompt tende a se comportar de forma parecida. A diferença está nas salvaguardas: o Fable 5.1 é de disponibilidade geral e o Mythos 5.1 só é liberado via programa de acesso confiável, o que pode mudar quais pedidos passam sem recusa.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Como escrever prompts melhores no Claude (com exemplos de antes e depois)
Veja como escrever prompts para Claude mais eficazes: técnicas oficiais da Anthropic com exemplos reais de antes e depois para melhorar suas respostas.
Como criar uma persona de IA com instruções de sistema (exercício prático com Claude Frollo)
Persona de IA não nasce de 'seja simpático': aprenda a escrever instruções de sistema com papel, voz e limites reais, usando o Claude Frollo como exercício.
Certificado de engenharia de prompt vale a pena? O que ele prova e o que não prova
Certificado de engenharia de prompt vale a pena? Veja o que ele prova, o que não prova e quando vale pagar por um, com opções gratuitas de estudo.
