Como resumir textos longos no ChatGPT grátis sem perder informação importante

Para resumir textos longos no ChatGPT no plano Free, o segredo não é prompt mágico, é método: fatiar o material por unidade lógica (capítulo, seção, cláusula), resumir bloco por bloco num formato fixo e obrigatório, depois consolidar os resumos parciais em uma segunda camada e fechar com uma verificação cruzada pedindo o que foi descartado. Isso resolve o resumo raso porque o Free trabalha com janela de contexto de 27K tokens (entrada mais saída) e 3 uploads de arquivo por dia. Texto puro vai colado no chat, o botão Think entra nos blocos difíceis, e conversa nova zera o acúmulo.
Você cola um documento gigante no ChatGPT, pede um resumo, e volta um textinho de três linhas que basicamente repete a introdução do material
Ou pior: o resumo parece bom, você confia, e só semanas depois descobre que um capítulo inteiro nunca entrou na conta
O problema quase nunca é o modelo ser burro
É o texto não caber inteiro na conversa. A conversa tem um teto de tamanho, e quando você joga o documento todo de uma vez, boa parte dele simplesmente não participa do raciocínio
A saída é chata e funciona: fatiar o material em blocos, resumir cada bloco com formato obrigatório, e só depois consolidar em camadas
É mais trabalho? Um pouco
Mas é a diferença entre um resumo decorativo e um resumo que você usaria numa reunião, num edital ou numa prova
O que o plano Free do ChatGPT permite (e onde ele trava)
Antes do passo a passo, vale entender o terreno. Porque o método existe por causa desses limites, não por capricho
No plano Free o modelo padrão é o GPT-5.6 Luna. O GPT-5.6 Sol não está incluído nem no Free nem no Go
Conversa de texto no Free é ilimitada no dia a dia, sujeita a salvaguardas contra abuso. Ou seja: bater papo em texto não é o gargalo aqui
O gargalo é a janela de contexto
O que é janela de contexto, na prática:
Janela de contexto é o total de tokens que a conversa comporta de uma vez
E "de uma vez" conta tudo junto: suas mensagens, os arquivos anexados, as respostas do modelo, mais as instruções de sistema e memórias que rodam por baixo
Se você conhece o conceito de RAM, a analogia serve: é a mesa de trabalho da conversa. Cabe o que cabe, e quando enche, algo fica de fora
Detalhe importante: o espaço realmente disponível para VOCÊ é menor que o número total, porque instruções de sistema, memórias e processamento interno ocupam parte dessa mesa, e isso varia dinamicamente
Os números oficiais por plano, no modelo instantâneo:
| Plano | Janela de contexto (modelo instantâneo) |
|---|---|
| Free | 27K tokens |
| Go | 54K tokens |
| Plus | 54K tokens |
| Pro | 128K tokens |
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 120 aulas
- 4 projetos
- 9h 45min
E nos modelos de raciocínio, entre os planos pagos:
| Plano | Janela de contexto (modelos de raciocínio) |
|---|---|
| Go, Plus, Business e Enterprise | 256K tokens |
| Pro | 400K tokens |
Repare no salto
Um usuário Pro empurra documento gigante na conversa e sai andando. No Free, com 27K de janela total, o documento grande precisa ser trabalhado em partes. Não tem jeito
Os limites de arquivo no Free:
- 3 uploads de arquivo por dia
- 512 MB por arquivo (esse teto vale para todos os planos)
- 2 milhões de tokens por arquivo de texto ou documento (não se aplica a planilhas)
- cerca de 50 MB para CSV e planilhas, com o limite dependendo do tamanho de cada linha
- 500 MB de armazenamento na Library, que é uma cota separada dos limites diários de chat e de anexos
Repare que são réguas diferentes, e é aqui que muita gente se enrola: o teto por arquivo fala do que a conversa aceita receber num envio, e a cota da Library fala de quanto material fica guardado na sua conta ao longo do tempo. Uma coisa não é a mesma que a outra
Agora o ponto que quase todo mundo interpreta errado
O teto de 2 milhões de tokens por arquivo NÃO significa que 2 milhões de tokens entram no seu raciocínio
Uma coisa é o arquivo ser aceito no upload. Outra coisa é o conteúdo caber na janela da conversa, que no Free é de 27K tokens contando entrada e saída
Arquivo aceito e conteúdo lido por inteiro são coisas diferentes. Guarda essa frase, porque é ela que explica o resumo raso
Vale a mesma lógica que rola em qualquer ferramenta de leitura assistida, incluindo as alternativas para revisar textos longos sem perder o contexto: o que manda é quanto do material está efetivamente na mesa na hora da resposta
Passo a passo: resumo em camadas sem perder informação
O fluxo é em três camadas: resumo por bloco, consolidação, verificação
Nada de prompt secreto aqui, é processo mesmo. Bora?
- Defina o objetivo do resumo ANTES de colar qualquer coisa
Escreva numa linha o que esse resumo precisa entregar, e o que não pode ser perdido de jeito nenhum: números, nomes, datas, prazos, decisões, valores, cláusulas
Sem isso o modelo escolhe sozinho o que é importante, e ele vai escolher o que é bonito, não o que é crítico
O erro comum deste passo: pedir "faça um resumo". Resumo de quê, pra quê, pra quem? Resposta genérica nasce de pedido genérico
- Fatie o texto por unidade lógica, nunca por corte aleatório
Capítulo, seção, cláusula, bloco de perguntas, dia da ata. A unidade tem que fazer sentido sozinha
Cortar no meio de uma frase ou no meio de um raciocínio é o jeito mais rápido de produzir resumo confuso, porque o bloco chega sem começo e sem fim
Regra prática de tamanho: comece com um bloco por capítulo ou seção. Se a resposta vier boa no início do bloco e vaga no final, seu bloco está grande demais para a janela de 27K, corta pela metade e roda de novo
Esse teste empírico vale mais que tentar contar token na mão
O erro comum deste passo: dividir por quantidade de páginas ignorando onde a ideia termina
- Se o material é texto puro, cole no chat em vez de gastar upload
Você tem 3 uploads de arquivo por dia no Free
Texto puro colado na mensagem não consome essa cota. Guarde os uploads para o que realmente precisa ser arquivo, tipo PDF com formatação que importa, planilha ou CSV
O erro comum deste passo: queimar os 3 uploads do dia enviando o mesmo documento três vezes só porque o primeiro resumo veio ruim
- Use um prompt-padrão de bloco, com formato fixo e obrigatório
Formato obrigatório é o que mata o resumo decorativo. Se a saída tem campos que precisam ser preenchidos, o modelo é forçado a passear pelo bloco inteiro
Vou te enviar o BLOCO X de Y de um documento maior
(troque X e Y pelos números reais do seu fatiamento).
Não resuma o documento todo, resuma SÓ este bloco.
Responda exatamente neste formato:
BLOCO X de Y
1. Assunto do bloco em uma linha
2. Pontos principais em tópicos
3. DADOS LITERAIS: todos os números, datas, nomes, valores e prazos
citados, copiados exatamente como aparecem no texto
4. DECISÕES / OBRIGAÇÕES / PRAZOS (se houver)
5. TRECHOS AMBÍGUOS: o que ficou pouco claro ou pode ter mais de
uma leitura
6. O QUE EU DEIXEI DE FORA deste bloco e por quê
Não invente nada. Se algo não existe no bloco, escreva "não consta".
Texto do bloco:
---
cole o texto do bloco aqui
---
O campo 6 é o mais subestimado. Pedir explicitamente o que foi descartado te dá um mapa do buraco antes de você cair nele
O erro comum deste passo: mudar o formato de um bloco para o outro. Na hora de consolidar, formatos diferentes viram salada
- Numere os blocos e exija a numeração na resposta
Repare que o prompt acima começa com BLOCO X de Y
Isso não é enfeite. É o seu detector de bloco pulado: se você mandou 9 blocos e só tem 8 respostas numeradas, você ENXERGA a falha
Sem numeração, bloco perdido passa batido e você só descobre quando alguém pergunta do que faltou
O erro comum deste passo: mandar dois blocos na mesma mensagem. Aí o modelo funde os dois e a numeração deixa de proteger você
- Camada 2: consolide os resumos parciais
Agora você não trabalha mais com o documento original, trabalha com os resumos. Que são muito menores, ou seja, cabem melhor na janela
Abaixo estão os resumos dos blocos 1 a Y do mesmo documento
(Y é o total de blocos que você fatiou).
Monte UM resumo consolidado com estas regras:
- nenhum número, data, nome ou valor pode ser descartado: todos
precisam aparecer no consolidado
- agrupe por tema, não na ordem dos blocos
- marque contradições entre blocos numa seção "CONFLITOS"
- no fim, liste os blocos que você usou por número
Resumos:
---
cole os resumos parciais aqui
---
O erro comum deste passo: pedir a consolidação na mesma conversa já lotada dos blocos originais. A conversa está cheia, e aí o próprio consolidado sai truncado. Consolide em conversa nova, colando só os resumos
- Camada 3: verificação cruzada
Essa é a camada que quase ninguém faz e é a que salva o resumo
Compare o resumo consolidado com os resumos de bloco abaixo.
Responda em três listas, item por item:
1. O que estava nos resumos de bloco e NÃO está no consolidado
2. Todo número, data e nome que aparece em um e não no outro
3. Afirmações do consolidado que você não consegue apontar em
nenhum bloco
Regras:
- se uma lista ficar vazia, escreva "nenhum item" nela
- cite o número do bloco em cada item apontado
- não reescreva o consolidado nesta resposta, só aponte as diferenças
Resumo consolidado:
---
cole o consolidado aqui
---
Resumos de bloco:
---
cole os resumos de bloco aqui
---
O item 3 é caça a invenção. Se aparecer coisa ali, você tem um problema e agora sabe onde
O erro comum deste passo: aceitar a resposta "está tudo coberto" sem pedir a lista item por item
- Chame o botão Think nos blocos difíceis
O botão Think está disponível no Free e roda o GPT-5.6 Luna, também sujeito às proteções antiabuso
Para acionar: no app mobile, abra o menu + e selecione Think. Na web, selecione Think ao enviar a pergunta
Usa onde vale o esforço: bloco cheio de cláusula, bloco com números conflitantes, e principalmente na camada 3 de verificação
O erro comum deste passo: achar que Think no Free entrega o GPT-5.6 Sol. Não entrega, o Sol não está incluído em Free e Go
- Abra conversa nova para zerar o acúmulo
Cada mensagem que você manda e cada resposta que volta ocupa espaço na mesma janela
Então a conversa vai ficando pesada sozinha, mesmo que você não cole mais nada. Depois de alguns blocos, a mesma pergunta começa a render resposta pior
Rotina que funciona: uma conversa para os blocos (ou mais de uma, se o material é grande), uma conversa limpa para a consolidação, uma conversa limpa para a verificação
O erro comum deste passo: fazer o documento inteiro numa única thread infinita e culpar o modelo pela queda de qualidade
- Use Projects para manter o material junto
Projects está incluído no plano Free, com 5 arquivos de origem por projeto (no Go e no Plus são 25, e em Edu, Pro, Business e Enterprise são 40)
É ótimo para documento que você vai revisitar por semanas: edital, contrato, apostila, manual
O erro comum deste passo: tratar Projects como se fosse janela de contexto maior. Não é. Ele organiza o material, o teto da conversa continua sendo o do seu plano
O que aparece na prática quando o arquivo entra no ChatGPT
Na Imersão GPT eu fiz uma demonstração ao vivo justamente com arquivo, e ela explica muito bem por que esse método de camadas existe
No vídeo eu mostro o ChatGPT recebendo arquivo enviado pelo usuário e usando aquilo para resumir conteúdo. Citei o caso clássico de mandar um e-book e pedir um resumo
Depois fui pra prática com uma planilha (não um texto longo). Anexei pelo clipe, perguntei simplesmente "o que tem nesse arquivo", e a ferramenta identificou as colunas e trouxe uma pré-visualização dos dados
E aqui está o detalhe que vale o post inteiro: essa pré-visualização não mostrou todos os registros
Mostrou os cinco primeiros registros, uma amostra
Se liga no que isso significa
Ver o arquivo carregado e ver dados aparecendo na tela dá uma sensação de "ele leu tudo". Só que amostra é amostra
É exatamente esse conforto visual que faz a pessoa confiar num resumo que ignorou metade do material. Você viu algo acontecer, então assumiu que aconteceu com o documento completo
Da mesma planilha eu pedi um gráfico de barras com a renda das pessoas, e ele gerou o gráfico ali na hora. Muito massa pra quem quer usar o ChatGPT como auxiliar de analista de dados, enviando planilha, arquivo de texto e imagem pra análise
Mas repare no padrão: quanto mais o material é grande, mais a resposta trabalha com uma parte dele
Outra coisa que eu mostro ali é o chat temporário, que roda sem puxar o contexto de conversas anteriores
Útil demais quando você não quer misturar informação de outros assuntos na resposta. Fora dele, o ChatGPT vai guardando contexto entre conversas diferentes (seu nome, sua área de trabalho e por aí vai), e isso ajuda ou atrapalha dependendo do que você está tentando fazer
E teve o momento em que um espectador perguntou sobre limite de perguntas no plano free. Ali eu especulei que o sistema deve trocar automaticamente pra um modelo com menos inteligência quando o limite é atingido, e que por isso trocar de modelo na mão não faria muita diferença
Deixo registrado como palpite meu naquele momento, não como regra oficial, beleza? 🙂
No vídeo você vê o anexo entrando, a pré-visualização com a amostra dos registros, o gráfico sendo gerado e a explicação do chat temporário
Resumo raso, parte ignorada e outros problemas clássicos
O resumo só repete a introdução:
Sintoma: três parágrafos bonitos que qualquer pessoa escreveria depois de ler a primeira página
Causa: bloco grande demais para a janela, somado a um prompt sem formato obrigatório. Sem campo pra preencher, o modelo entrega a versão mais barata de resposta possível
Solução: corta o bloco em dois e roda o prompt-padrão com os campos de dados literais e de trechos ambíguos
Prevenção: nunca pedir resumo sem formato de saída definido
Um trecho inteiro simplesmente sumiu:
Sintoma: você procura um assunto que você SABE que está no documento e não acha no resumo
Causa: duas de uma vez. A conversa já estava carregada quando aquele trecho entrou, e o corte não respeitou unidade lógica, então o conteúdo chegou partido no meio
Solução: numeração de bloco (BLOCO 4 de 9) para você conferir a contagem, e conversa nova para rodar os blocos que faltaram
Prevenção: um bloco por mensagem, sempre numerado, cortado por capítulo ou seção
Números e nomes trocados:
Sintoma: o resumo diz um valor, o documento diz outro. Ou um nome aparece atribuído à pessoa errada
Causa: paráfrase. Quando o modelo reescreve em vez de copiar, dado preciso é exatamente o que se degrada
Solução: o campo DADOS LITERAIS, com instrução de copiar exatamente como aparece no texto, mais a camada 3 pedindo todo número e nome que aparece em um lado e não no outro
Prevenção: todo dado crítico do resumo final tem que ser rastreável até um bloco numerado
"Não consigo mais enviar arquivos hoje":
Sintoma: o upload para de funcionar no meio do trabalho
Causa: são 3 uploads de arquivo por dia no plano Free. E vale lembrar que recursos avançados como upload de arquivo, análise de dados e criação de imagem têm limites separados e mais restritos no Free, com o próprio ChatGPT avisando quando o limite é atingido
Solução: se o conteúdo é texto puro, cola no chat. Colar não gasta upload
Prevenção: olha sua situação de armazenamento antes de começar. Os arquivos enviados e criados no ChatGPT ficam na Library, que abre pela barra lateral esquerda, e dentro dela o botão Storage mostra uso total, espaço restante e se você passou do limite. No Free a cota é de 500 MB, e esse armazenamento é separado dos limites diários de chat e de anexos
O modelo mistura informação de outra conversa:
Sintoma: o resumo do seu contrato vem temperado com contexto de um projeto que não tem nada a ver
Causa: a memória, que está disponível no Free em versão mais leve, com continuidade de curto prazo entre conversas (Plus e Pro têm entendimento de prazo mais longo)
Solução: dá pra desligar em Settings > Personalization > Memory, e ver ou apagar memórias específicas em Settings > Personalization > Manage Memory
Prevenção: trabalho de resumo que precisa de isolamento roda em Temporary Chat. Bônus: arquivo enviado no Temporary Chat não fica salvo na conta nem na Library
Como adaptar o método a cada tipo de material
O fluxo das três camadas é o mesmo. O que muda é o critério de corte e o formato da saída
Contrato, edital ou regulamento:
Corte por cláusula ou por item numerado, nunca por página
Na saída, o campo de dados literais vira obrigatório e cheio: prazo, valor, percentual, data limite, condição de desclassificação, tudo copiado como está escrito
Aqui o campo de trechos ambíguos é ouro, porque contrato vive de interpretação dupla
Pra quem está nessa pegada de estudo com documento oficial, vale ver também esse caminho de resumir edital e apostila para concursos, que ataca o mesmo problema por outro lado
Artigo científico ou relatório longo:
Corte pelas seções naturais (introdução, método, resultados, discussão)
Duas camadas de verdade aqui: resumo por seção, depois uma síntese que responde "o que esse trabalho afirma, com que evidência, e com que limitação"
Número de amostra e resultado quantitativo vão no campo literal, sempre
Transcrição de aula ou reunião:
Corte por bloco de tempo ou por mudança de assunto
E muda o formato de saída: em vez de tópicos genéricos, pede decisões, pendências, responsáveis e prazos. Transcrição resumida em tópicos bonitos é inútil, o valor está no que ficou combinado
Planilha ou CSV:
Esse é outro animal
Planilha e CSV têm limite próprio de cerca de 50 MB, dependendo do tamanho de cada linha, e o teto de 2 milhões de tokens por arquivo de texto não se aplica a planilha
Só que a pré-visualização mostra amostra, como aparece na demonstração do vídeo. Então não pergunte "o que tem aqui" e saia confiando
Pergunte coisa específica e verificável: contagem, soma, agrupamento, mínimo e máximo por coluna. E confira um número na mão antes de usar o resto
Material que você vai reusar por semanas:
Projects, que está incluído no Free com até 5 arquivos de origem por projeto
Deixa ali o documento base e os resumos consolidados que você já produziu. Na semana seguinte você não recomeça do zero, você continua de onde parou
Conclusão
O resumo raso no plano gratuito não é destino, é consequência de jogar material grande numa janela pequena e esperar milagre
No Free você tem GPT-5.6 Luna, conversa de texto ilimitada sujeita a proteções antiabuso, botão Think, 27K tokens de janela, 3 uploads por dia e Projects com 5 arquivos
Com esse kit e um pouco de método, dá pra extrair resumo confiável de documento grande. O ganho vem do processo, não do plano
O fluxo inteiro em uma frase: corta por unidade lógica, resume cada bloco numerado em formato obrigatório, consolida em conversa limpa e fecha com verificação cruzada pedindo o que foi descartado
Próximo passo, hoje mesmo: pega um documento real que está te travando, corta em blocos por capítulo ou seção, e roda as três camadas em um único material
Você vai sentir a diferença já no primeiro consolidado, sério
Da uma olhada também na aula que deixei aqui em cima pra ver o comportamento do anexo na prática, e depois se joga nos outros conteúdos de IA aqui do blog
até o próximo post! 😀
Perguntas frequentes
Por que o ChatGPT grátis não consegue resumir um documento inteiro de uma vez
Porque a janela de contexto do modelo instantâneo no plano Free é de 27K tokens, contando entrada e saída juntas
Quando o documento é maior que isso, parte do conteúdo simplesmente não participa da resposta, mesmo que o upload tenha sido aceito
Arquivo aceito no upload significa que o ChatGPT leu ele por inteiro
Não, e essa é a confusão mais comum
O limite de 2 milhões de tokens por arquivo de texto ou documento é sobre o que pode ser enviado, não sobre o que entra no raciocínio da conversa, que segue limitado pela janela de contexto do plano
Vale mais colar o texto direto no chat ou enviar como arquivo pra resumir
Se o material é texto puro, colar direto no chat economiza a cota de uploads, que no Free é de 3 arquivos por dia
Reserve o upload pra quando a formatação importa mesmo, como PDF, CSV ou planilha
O botão Think do ChatGPT Free ajuda a resumir textos longos
O Think existe no plano Free e roda no GPT-5.6 Luna, o mesmo modelo padrão do plano
Ele ajuda em perguntas mais difíceis de raciocínio, mas não aumenta a janela de contexto disponível, então o fatiamento continua necessário
Qual a diferença de janela de contexto entre o ChatGPT Free e o Pro pra resumir textos longos
No modelo instantâneo, o Free tem 27K tokens de janela total contra 128K do Pro
É por isso que quem paga Pro consegue jogar documento grande de uma vez e quem está no Free precisa dividir em blocos menores
Enviar planilha ou CSV pra resumir tem o mesmo limite de um PDF no ChatGPT
Não, CSV e planilhas têm limite próprio, de aproximadamente 50 MB, dependendo do tamanho de cada linha
Já arquivos de texto e documento seguem o teto de 2 milhões de tokens por arquivo, então são regras diferentes
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
O que significa “ChatGPT network error” e como resolver
O “ChatGPT Network Error” é uma ocorrência frequente na rotina de muitos usuários do ChatGPT. Porém, poucos compreendem seu significado, quando esse erro surge, etc. […]
ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
Como acessar o ChatGPT? Guia de login chat OpenAI
Como acessar o ChatGPT? O ChatGPT foi lançado pela OpenAI, empresa de pesquisa em inteligência artificial, em 30 de novembro de 2022 (em 2020 o […]
