Conversa longa no ChatGPT ignora o que foi combinado? Como dividir a tarefa para não perder o contexto (plano Free)

diagrama mostrando como dividir uma conversa longa no ChatGPT em blocos menores no plano Free
Resposta rápida

Se a sua conversa longa no ChatGPT começou combinando tudo e agora ignora metade do que foi acertado, o problema é estrutural. No plano Free a janela de contexto e a memória são mais limitadas que nos planos pagos, e o estudo "LLMs Get Lost In Multi-Turn Conversation" mostra queda média de 39% em diálogos de múltiplos turnos. A saída é fatiar: uma entrega por conversa, um bloco de contexto reutilizável nas instruções do projeto (Projects está no Free), regras duras em Custom Instructions e saved memories, e branch quando quiser testar outro caminho sem sujar o fio original

Você abre o chat, explica o projeto inteiro, combina formato, tom, restrição, o que NÃO fazer

e trinta respostas depois o modelo devolve exatamente aquele formato que vocês tinham descartado lá no começo 😅

Se já te aconteceu, calma: não é você escrevendo prompt ruim. No plano Free a janela de contexto e os recursos de memória são mais limitados que nos planos pagos, e diálogo comprido degrada por natureza

A saída não é prompt secreto, é organização. Bora fatiar a tarefa em conversas menores, montar um bloco de contexto reutilizável e retomar do ponto certo sem repetir tudo de novo?

Por que a conversa longa começa a ignorar o que foi combinado

São duas frentes, e elas se somam

Frente 1: o Free aperta mais. No plano gratuito, contexto e memória são mais limitados do que nos planos pagos. O comportamento é bem visível: quanto mais o fio cresce, menos espaço sobra pro que foi dito lá no início

Frente 2: múltiplos turnos derrubam o modelo, em qualquer plano. O estudo "LLMs Get Lost In Multi-Turn Conversation", de Philippe Laban, Hiroaki Hayashi, Yingbo Zhou e Jennifer Neville (Microsoft Research e Salesforce Research), está no arXiv e mediu isso em seis tarefas de geração

O resultado é duro: queda média de 39% no desempenho quando a instrução vai sendo revelada aos poucos, em vários turnos, comparado com o mesmo pedido completo num turno só

E o mais interessante é a decomposição. Em mais de 200.000 conversas simuladas, a degradação vem principalmente de +112% de inconsistência, não de perda de capacidade (a aptidão cai só 15%)

Traduzindo pro português do dia a dia: o modelo não ficou burro, ele ficou errático

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 120 aulas
  • 4 projetos
  • 9h 45min

Ele assume coisas cedo demais, tenta cravar a solução final antes da hora e, quando pega o rumo errado, não volta atrás sozinho. Aí você passa as próximas vinte mensagens corrigindo alguém que já decidiu o que ia fazer

Vale lembrar que isso não é exclusividade do plano gratuito: o estudo mediu o comportamento de múltiplos turnos em si, ou seja, conversa comprida degrada em qualquer plano

Ou seja: o problema é estrutural. Não é falta de habilidade sua, e não se resolve escrevendo o prompt mais bonito do mundo dentro do mesmo chat infinito

O que você precisa antes de começar

Nada de PC da Nasa aqui, mas tem alguns pré requisitos e alguns tetos que você precisa conhecer ANTES, pra não montar o fluxo errado:

  • Conta Free logada. Projects e o recurso de ramificar conversa aparecem pra usuários logados na web, então nada de fazer isso deslogado
  • Modelo do Free: GPT-5.6 Luna, com o modo Think disponível no app mobile e em rollout na web
  • GPT-5.6 Sol não é pro Free. Ele está em rollout apenas para planos pagos elegíveis, e isso exclui Free, Go e deslogados. Se o seu plano é gratuito, monte o fluxo contando com o que você tem
  • Texto é ilimitado, tool não é. Os chats de texto do dia a dia no Free são ilimitados (sujeitos a salvaguardas antiabuso), mas upload de arquivos, geração de imagem, voz e análise de dados têm limites de uso separados, e o ChatGPT avisa quando você bate no limite
  • 5 arquivos por projeto no Free. Esse teto muda o desenho: seu bloco de contexto precisa ser enxuto, não uma biblioteca
  • 1.500 caracteres nas instruções personalizadas (Free e Go). Dá bastante coisa, mas não dá pra colar um documento inteiro lá

Tome cuidado com o último: gente que tenta transformar Custom Instructions em briefing completo acaba cortando a regra mais importante no meio da frase

Passo a passo: dividir a tarefa em conversas menores sem repetir tudo

A lógica geral é simples: a conversa vira unidade de entrega, não o projeto inteiro. E o contexto passa a morar FORA do chat, num lugar reutilizável

  1. Mapeie a tarefa em fatias fechadas, uma entrega por conversa

Antes de abrir qualquer coisa, escreva numa lista o que precisa sair pronto. Cada item vira um chat. Se um item não tem entregável claro ("ajustar o projeto"), ele não é uma fatia, é um guarda chuva

O erro comum deste passo: fatiar por assunto em vez de fatiar por entrega. "Backend" não é fatia, "endpoint de login funcionando" é

  1. Crie o projeto

Projects está disponível no plano Free. O caminho: abrir Projects no menu da esquerda, criar um novo projeto e dar um nome. Depois dá pra adicionar arquivos, definir as instruções do projeto ou mover chats já existentes pra dentro dele

Esse último detalhe salva quem já está com a conversa longa no ChatGPT estourada: você não precisa recomeçar, move o chat velho pra dentro do projeto e segue a partir dali

O erro comum deste passo: criar um projeto por tarefa. O projeto é o guarda chuva, as fatias é que são as conversas

  1. Escreva o bloco de contexto reutilizável

Esse é o coração do método. É um texto curto que responde: qual o objetivo, o que já foi decidido, o que é restrição, qual o formato de saída e o que NÃO fazer

Ele mora nas instruções do projeto, e opcionalmente num arquivo (lembrando do teto de 5 arquivos por projeto no Free)

OBJETIVO
API de agendamento para clínica pequena, foco em simplicidade

DECISOES JA TOMADAS (nao reabrir)
- Stack: Node + Postgres
- Autenticacao: JWT, sem OAuth
- Sem ORM, SQL na mao

RESTRICOES
- Sem dependencia nova sem eu pedir
- Nomes de variavel em ingles, comentarios em pt-BR

FORMATO DE SAIDA
- Codigo primeiro, explicacao curta depois
- Nada de passo a passo de instalacao, eu ja tenho o ambiente

O QUE NAO FAZER
- Nao sugerir troca de stack
- Nao entregar solucao final antes de confirmar o escopo da fatia

Repare naquela última linha. Ela existe justamente por causa do comportamento que o estudo descreve: o modelo tende a cravar a solução final cedo demais

O erro comum deste passo: escrever contexto narrativo ("estou desenvolvendo um sistema que…"). Bloco de contexto é lista de decisão, não redação

  1. Fixe o que vale pra TODOS os chats em Custom Instructions

Aqui entra só o que é seu, permanente, independente de projeto: como você quer ser respondido, nível de detalhe, idioma, tom

O caminho: Settings > Personalization > Custom Instructions, com o toggle "Enable customization" ligado, e você escreve no campo Custom Instructions

As instruções passam a valer imediatamente em todos os chats, e dá pra editar ou apagar quando quiser. No Free e no Go o teto é de 1.500 caracteres (nos planos pagos maiores vai até 5.000)

Responda em pt-BR, direto ao ponto
Nada de introducao generica nem resumo do que eu pedi
Se faltar informacao, pergunte antes de assumir
Quando eu disser FATIA, trate apenas o escopo daquela fatia

O erro comum deste passo: jogar contexto de UM projeto aqui dentro. Isso vaza pra todos os seus chats, inclusive os que não têm nada a ver

  1. Salve as decisões duras como memória

Saved memories são os detalhes que você pede explicitamente pro ChatGPT lembrar. Dá pra criar uma a qualquer momento com um pedido no formato "Remember that…", tipo:

Remember that neste projeto a stack eh Node + Postgres e nao usamos ORM

Pra conferir e gerenciar o que está guardado: Settings > Personalization > Memory

Dois detalhes que importam MUITO aqui. Primeiro: as saved memories ficam guardadas separadamente do histórico de chats, então apagar a conversa original não apaga automaticamente a memória salva. Segundo: no plano Free o ChatGPT tem acesso apenas a saved memories, o recurso "Reference chat history" (puxar informação relevante de conversas passadas) é de planos pagos

E tem uma ressalva honesta: a memória não guarda todo detalhe de toda conversa. O modelo decide qual informação disponível é relevante pra resposta, e isso pode mudar conforme o contexto muda

Ou seja, memória é apoio, não é cofre. O bloco de contexto continua sendo a fonte da verdade

O erro comum deste passo: salvar preferência efêmera como memória ("remember that hoje eu quero respostas curtas"). Memória é pra decisão que dura

  1. Abra uma conversa nova por fatia

Cada fatia começa limpa, dentro do projeto, apontando o bloco de contexto e dizendo o estado atual. Algo assim:

FATIA 3: endpoint de cancelamento de agendamento

Estado atual: fatias 1 e 2 entregues (CRUD de cliente e criacao de agendamento)
O cancelamento precisa respeitar a regra de 24h de antecedencia
Nao mexa no que ja foi entregue, so escreva este endpoint

O erro comum deste passo: recomeçar a conversa colando o projeto inteiro. Não precisa. O contexto fixo já está nas instruções do projeto, aqui vai só o delta

  1. Ramifique quando quiser testar outro caminho

Sabe quando você quer experimentar uma abordagem diferente mas tem medo de estragar um fio que está bom? É pra isso que serve o branch

Na web, com usuário logado: passe o mouse sobre a mensagem, clique em More actions (⋯) e escolha "Branch in new chat". Isso abre uma conversa separada a partir daquele ponto

A original fica preservada, e dentro de um projeto os chats ramificados aparecem ao lado da conversa original. Perfeito pra comparar dois caminhos sem ficar mandando "esquece o que eu falei" 😀

O erro comum deste passo: tentar isso no celular esperando o mesmo caminho. O fluxo confirmado é o da web, então é por lá que eu te mostro

  1. Feche cada conversa com um resumo de handoff

Antes de abandonar a fatia, peça um resumo curto que sirva de entrada pra próxima:

Feche esta fatia num bloco de handoff com:
- o que ficou pronto
- decisoes novas que tomamos aqui
- pendencias
- o que a proxima conversa precisa saber
Maximo 10 linhas, sem explicacao extra

Esse bloco você cola no início da próxima conversa, ou promove pras instruções do projeto se virou decisão permanente

O erro comum deste passo: pedir resumo "da conversa". Você não quer ata de reunião, quer estado do projeto

Três formas de fatiar, conforme o tipo de projeto

O método é o mesmo, o recorte muda. Se liga:

Projeto de código

Uma conversa por módulo ou por bug. As decisões de stack, padrão de código e o que não pode ser tocado ficam nas instruções do projeto

Bloco de contexto leva: stack, estrutura de pastas em texto, convenção de nome, e a lista do que já está entregue

Branch aqui é ouro pra comparar duas implementações do mesmo trecho sem perder a primeira

Produção de conteúdo

Separe em pesquisa, estrutura, redação e revisão. Cada etapa numa conversa

Por quê? Porque o chat de pesquisa fica cheio de material bruto que só atrapalha na hora de escrever. Se você tenta fazer tudo no mesmo fio, a redação começa a arrastar sobra de pesquisa

Bloco de contexto leva: público, tom, formato, tamanho, e o que já foi descartado (isso importa mais do que parece)

Estudo ou planejamento longo

Uma conversa por etapa do plano, e branch quando quiser comparar alternativas (dois cronogramas, duas abordagens de estudo, dois recortes de escopo)

Bloco de contexto leva: objetivo final, prazo, restrição real (tempo por dia, orçamento) e o que já foi decidido

E aqui vale o mesmo raciocínio de quando não vale delegar a tarefa: fatia grande demais e mal definida não fica melhor só porque você mandou pra IA

Sintomas de que a conversa estourou o contexto (e o que fazer em cada caso)

Dá pra perceber antes de perder a tarde. Os sinais são bem característicos:

Sintoma Causa provável Ação
Volta um formato que vocês já descartaram A regra ficou lá atrás e saiu do alcance Abra chat novo com o bloco de contexto e coloque o "não fazer" explícito
Reintroduz requisito que foi removido Inconsistência entre turnos, o modelo pinça a versão velha Transforme a remoção em decisão escrita nas instruções do projeto
Esquece nome de variável, arquivo ou pessoa Detalhe específico perdido no meio do fio Vire saved memory com "Remember that…" se for permanente
Entrega a solução final antes de entender o escopo Comportamento típico de multi-turn (+112% de inconsistência no estudo) Recorte a fatia e diga o escopo no primeiro turno, completo
Você corrige e ele erra de novo igual O rumo errado já contaminou o fio Ramifique do último ponto bom em vez de insistir

Repare que quase toda ação é a mesma coisa por outro nome: tirar a informação de dentro do chat e colocar num lugar que não se perde

Como prevenir

  • Uma entrega por conversa, sem exceção. Se o escopo cresceu no meio, abre outra
  • Handoff SEMPRE antes de fechar a fatia. Custa trinta segundos e economiza meia hora
  • Decisão que você repetiu duas vezes vira instrução do projeto ou saved memory. Se você está repetindo, o sistema é que está errado
  • Quando sentir o primeiro sintoma, não negocie com o fio. Ramifique ou recomece limpo

E não, eu não vou te dar aquele número mágico de "quebre a cada 30 mensagens". Isso circula em blog por aí sem base nenhuma na documentação. O gatilho é o sintoma, não o contador

O que o Free já dá (e onde ele ainda aperta)

Balanço honesto, porque o plano gratuito melhorou bastante e isso muda o jogo

O que joga a favor:

  • Chats de texto do dia a dia ilimitados (a liberação pra contas gratuitas foi noticiada em agosto de 2026). Isso é o que torna o método viável: abrir cinco conversas em vez de uma não te custa mensagem
  • Projects liberado pra contas gratuitas, na web e no app Android, com direito até a personalizar cor e ícone do projeto
  • Custom Instructions em todos os planos, na web, desktop, iOS e Android
  • Branch pra todos os usuários logados na web

Onde aperta:

Recurso Free Planos pagos
Arquivos por projeto 5 25 (Go e Plus), 40 (Pro, Business, Enterprise e Edu)
Custom Instructions até 1.500 caracteres (Free e Go) até 5.000 (Plus, Pro, Enterprise, Business e Edu)
Memória só saved memories saved memories + Reference chat history
GPT-5.6 Sol fora rollout em planos pagos elegíveis

Somando: contexto e memória mais limitados, sem puxar histórico de conversas passadas, e com teto baixo de arquivo por projeto

O que isso muda na rotina de quem toca projeto longo? Muda o peso de CADA peça. No Free, o bloco de contexto escrito à mão é o que segura a linha, porque você não tem o "Reference chat history" cobrindo os seus buracos

E olha que isso nem é tão ruim assim: contexto escrito à mão é contexto que VOCÊ controla. Quem trabalha assim reclama menos de resposta fora do combinado, em qualquer plano

Conclusão

O método inteiro cabe em três movimentos:

Fatiar (uma entrega por conversa, nunca o projeto inteiro no mesmo fio)

Fixar contexto (bloco reutilizável nas instruções do projeto, regra permanente em Custom Instructions, decisão dura em saved memory)

Ramificar (branch quando quiser testar outro caminho sem destruir o que já estava bom)

E o próximo passo prático é hoje mesmo: abra Projects no menu da esquerda, crie o projeto daquele trabalho que está te consumindo e escreva o bloco de contexto ANTES de mandar a próxima tarefa longa

Dá uns dez minutos. Bem menos do que você gasta explicando tudo de novo pela quarta vez 😛

Se você tentar, me conta como foi o recorte das suas fatias, tô curioso pra ver o que funciona em projeto de verdade…

até o próximo post!

Perguntas frequentes

Quantos arquivos posso colocar em um projeto do ChatGPT no plano Free?

No Free o limite é de 5 arquivos por projeto. Esse teto é bem menor que o dos planos pagos (25 no Go e Plus, 40 no Pro, Business, Enterprise e Edu), então o bloco de contexto precisa ser enxuto, não uma pasta cheia de documentos.

Qual a diferença entre ramificar (branch) uma conversa e simplesmente abrir um chat novo?

Ramificar cria uma conversa separada a partir de um ponto específico, sem alterar o chat original: basta passar o mouse sobre a mensagem, clicar em More actions (⋯) e escolher Branch in new chat. O recurso está disponível na web para todos os usuários logados, e dentro de um projeto os chats ramificados aparecem ao lado da conversa original.

Saved memories e Reference chat history são a mesma coisa no plano Free?

Não. No Free o ChatGPT só tem acesso a saved memories, que são detalhes pedidos explicitamente (tipo ‘Remember that…’). O recurso Reference chat history, que puxa informação relevante de conversas passadas automaticamente, está disponível apenas nos planos pagos.

Se eu apagar a conversa, a memória salva sobre mim também some?

Não. Saved memories ficam guardadas separadamente do histórico de chats, então apagar a conversa original não apaga automaticamente a memória salva. Você confere e gerencia isso em Settings > Personalization > Memory.

O modelo GPT-5.6 Sol está disponível para quem usa o ChatGPT no plano Free?

Não. O GPT-5.6 Sol está em rollout apenas para planos pagos elegíveis, e isso exclui Free, Go e usuários deslogados. Quem está no Free segue com o GPT-5.6 Luna, com o modo Think disponível no app mobile e em rollout na web.

Quantos caracteres cabem nas instruções personalizadas do ChatGPT no Free?

O Free e o Go têm limite de até 1.500 caracteres em Custom Instructions, contra até 5.000 nos planos Plus, Pro, Enterprise, Business e Edu. Dá pra colocar as regras principais, mas não um briefing inteiro.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares