- Pense na conversa como uma mesa 🧠
- ChatGPT, Claude e Gemini não fazem exatamente a mesma coisa
- E o Claude? Ele compacta a conversa 📦
- O Gemini pode apresentar outro sintoma
- Não repita a bronca. Faça um checkpoint 🔄
- Uma regra espalhada vira várias regras para a IA
- Quando o chat já virou uma bagunça, mude de sala 🚪
- E se você faz o mesmo trabalho toda semana? 📚
- Qual técnica usar? 🤔
- O número de mensagens não é o melhor termômetro 📏
- O melhor prompt pode ser o que você escreve antes do problema
Principais destaques
- O contexto tem limite: conversas longas podem fazer instruções antigas perderem espaço ou influência nas respostas.
- Cada IA lida de um jeito: ChatGPT, Claude e Gemini adotam estratégias diferentes quando uma conversa cresce demais.
- Há como reduzir o problema: checkpoints, blocos de regras, handoffs e Projects ajudam a manter o contexto importante acessível.
Você passa vinte mensagens construindo uma tarefa com o ChatGPT. Define o tom, limita o tamanho das respostas, explica o que deve ser evitado e deixa tudo funcionando.
Aí, algumas dezenas de mensagens depois, a IA começa a fazer exatamente o que você pediu para não fazer.
Você reclama. Ela pede desculpas. Corrige a resposta.
Três mensagens depois, volta a errar.
Não necessariamente é desatenção. Em muitos casos, é uma consequência de como os modelos lidam com contexto.
Pense na conversa como uma mesa 🧠
Cada nova mensagem adiciona informações que o modelo precisa considerar para produzir a próxima resposta. Esse conjunto disponível para processamento é, de forma simplificada, o contexto da conversa.
A analogia mais fácil é imaginar uma mesa de trabalho.
Ela pode ser enorme. Cabe texto, documentos, planilhas e dezenas ou até centenas de mensagens. Mas não é infinita.
Quando a conversa cresce, duas coisas podem acontecer.
Primeiro, partes antigas podem deixar de estar disponíveis para o modelo. Uma regra estabelecida na mensagem cinco pode simplesmente não estar mais no contexto utilizado para gerar uma resposta muito mais adiante.
Segundo, mesmo quando a informação ainda está disponível, ela passa a disputar atenção com tudo o que apareceu depois.
🔎 O efeito prático: uma instrução escondida entre dezenas de mensagens pode ser seguida com menos consistência do que a mesma instrução apresentada novamente perto do fim da conversa.
É daí que vem aquela sensação de que a IA “sabia” uma regra e, de repente, parou de saber.
💡 A IA não precisa ter apagado uma informação para começar a agir como se tivesse esquecido dela.
ChatGPT, Claude e Gemini não fazem exatamente a mesma coisa
O problema é parecido, mas cada plataforma administra conversas extensas de uma maneira diferente.
O texto-base destaca três comportamentos:
| Plataforma | Como lida com conversas longas |
|---|---|
| ChatGPT | Pode deixar conteúdo antigo fora do contexto conforme a conversa cresce |
| Claude | Pode compactar mensagens anteriores em um resumo |
| Gemini | Usuários já relataram perda de instruções anteriores antes do limite anunciado |
No caso do ChatGPT, existe ainda uma diferença importante entre contexto da conversa e memória.
A memória pode carregar determinados fatos entre conversas, mas isso não significa que uma conversa individual tenha espaço infinito para todas as mensagens anteriores.
Por isso, ativar memória não resolve necessariamente uma conversa que ficou longa demais.
E o Claude? Ele compacta a conversa 📦
O Claude adota uma estratégia diferente.
Quando a conversa se aproxima do limite, ele pode compactar o conteúdo anterior em um resumo e continuar trabalhando a partir dele.
Isso preserva a continuidade da conversa, mas cria uma espécie de filtro.
Uma instrução muito específica que estava em uma mensagem antiga pode sobreviver de maneira resumida, ser generalizada ou simplesmente desaparecer da síntese.
📌 O detalhe importante: você continua vendo a conversa inteira, mas isso não significa que cada detalhe histórico esteja sendo considerado da mesma maneira na geração da próxima resposta.
O Gemini pode apresentar outro sintoma
No caso do Gemini, o texto cita relatos de usuários que perceberam perda de instruções anteriores antes de atingir os limites que esperavam.
A recomendação prática é observar o comportamento, e não apenas o número anunciado de tokens.
Se a IA começa a contradizer regras estabelecidas, perguntar novamente algo que já foi explicado ou produzir respostas cada vez mais genéricas, pode ser um sinal de que o contexto está ficando menos eficiente.
E aqui aparece a parte mais útil da história.
Não repita a bronca. Faça um checkpoint 🔄
Quando a IA começa a escorregar, a reação mais comum é escrever algo como:
Você esqueceu as regras novamente. Mantenha abaixo de 200 palavras e não use bullets.
Funciona para a próxima resposta.
Mas existe uma abordagem mais estruturada: criar um checkpoint.
Antes de continuarmos, faça um checkpoint. Em menos de 120 palavras, liste: o objetivo desta conversa, todas as regras de formatação que estabeleci (limite de palavras, tom e coisas a evitar) e as decisões que já tomamos. Depois, siga esse checkpoint em todas as respostas daqui para frente.
A diferença é importante.
Em vez de corrigir apenas o erro atual, você força a IA a reconstruir uma pequena representação do que realmente importa na conversa.
Se alguma regra desaparecer do checkpoint, você descobre imediatamente que ela já não está sendo considerada.
Uma regra espalhada vira várias regras para a IA
Outro problema aparece quando as instruções são distribuídas ao longo de dezenas de mensagens.
Primeiro você pede para ser mais formal.
Depois solicita respostas mais curtas.
Mais tarde diz para não começar com “Certamente”.
Em seguida acrescenta uma regra sobre ortografia.
No final, há quatro instruções espalhadas por diferentes pontos da conversa.
Uma alternativa é consolidar tudo.
Estas são as REGRAS para tudo nesta conversa:
1. Tom formal, usando inglês britânico.
2. Máximo de 200 palavras por resposta.
3. Não usar bullets nem headings.
4. Nunca começar com "Certainly" ou "Great question".
Confirme que entendeu as REGRAS e aguarde minha próxima mensagem.
🧩 A vantagem: “verifique as REGRAS” passa a ser uma referência objetiva, em vez de uma reclamação vaga sobre algo que a IA deveria lembrar.
O mesmo princípio pode ser aplicado ao contexto factual.
Nome do cliente, produto, prazo, público, objetivo e decisões importantes podem ficar reunidos em um bloco de CONTEXTO.
Quando o chat já virou uma bagunça, mude de sala 🚪
Há um momento em que continuar remendando uma conversa deixa de fazer sentido.
Nesse caso, uma nova conversa pode funcionar melhor.
Mas não basta escrever “resuma esta conversa”.
O ideal é pedir um handoff, uma espécie de documento de transferência.
Escreva uma nota de handoff que eu possa colar em um novo chat para continuar este trabalho. Inclua: o que estamos tentando alcançar, as decisões tomadas até agora e por quê, as regras de formatação que estabeleci, qualquer coisa que você provavelmente erraria se tivesse que adivinhar e o próximo passo exato. Mantenha abaixo de 250 palavras.
Depois, no novo chat:
Continue a partir desta nota de handoff:
Cole o resultado.
💡 O momento de criar esse handoff é antes de a conversa ficar crítica, não depois.
Se o próprio chat já está começando a perder informações importantes, pedir que ele reconstrua todo o histórico pode ser tarde demais.
E se você faz o mesmo trabalho toda semana? 📚
Nesse caso, talvez o problema não seja a conversa.
É a estrutura.
Para trabalhos recorrentes, como newsletters, projetos de clientes, cursos ou produção editorial, manter tudo em um único chat gigantesco pode ser uma estratégia ruim.
É aí que entram os Projects disponíveis em ferramentas como ChatGPT e Claude.
A ideia é colocar as regras e os arquivos recorrentes no projeto, em vez de repetir tudo em cada nova conversa.
Por exemplo:
Todos os chats deste Project são para a newsletter semanal da Henley Bakery.
Proprietária: Priya.
Tom: acolhedor, simples e nunca infantilizado.
Nunca mencionar padarias concorrentes.
Cada edição deve ter uma receita, uma história de funcionário e uma oferta.
Limite de 400 palavras.
Usar o guia de estilo anexado para ortografia e nomes de produtos.
Agora, cada conversa pode começar menor, enquanto o contexto recorrente fica associado ao projeto.
No Gemini, o texto-base aponta os Gems como equivalente mais próximo para instruções persistentes, embora seja necessário combinar isso com handoffs quando o trabalho exigir continuidade histórica.
Qual técnica usar? 🤔
A escolha depende do problema.
Se uma regra começou a escapar: use um checkpoint.
Se está começando um trabalho longo: crie um bloco único de regras antes de avançar.
Se a conversa ficou confusa: faça um handoff e comece um novo chat.
Se o trabalho se repete toda semana: coloque as regras e arquivos recorrentes em um Project.
A diferença parece pequena, mas muda a maneira como você trabalha com IA.
Em vez de esperar que o modelo “lembre de tudo”, você transforma as informações importantes em algo mais fácil de recuperar e priorizar.
O número de mensagens não é o melhor termômetro 📏
Não existe uma quantidade universal de mensagens depois da qual uma IA começa a esquecer.
Isso acontece porque o consumo de contexto depende do conteúdo.
Uma mensagem curta ocupa muito menos espaço do que um documento enorme colado na conversa. Uma planilha extensa, um PDF ou uma sequência de respostas longas pode consumir muito mais contexto do que dezenas de perguntas simples.
Por isso, procurar um número mágico de mensagens pode ser enganoso.
Observe os sintomas:
• regras antigas deixam de ser seguidas;
• a IA volta a perguntar coisas que você já explicou;
• respostas começam a ficar mais genéricas;
• instruções específicas são substituídas por interpretações vagas;
• você passa mais tempo corrigindo a IA do que avançando no trabalho.
Quando isso acontece, talvez seja hora de reorganizar o contexto.
O melhor prompt pode ser o que você escreve antes do problema
A principal ideia é relativamente simples.
Conversas longas não precisam ser abandonadas assim que começam a ficar grandes. Mas também não vale esperar até que a IA esteja completamente perdida para reconstruir o contexto.
Um checkpoint periódico, um bloco centralizado de regras ou um handoff podem funcionar como pequenas placas de sinalização em uma estrada longa.
E isso muda a pergunta.
Em vez de perguntar apenas “por que a IA esqueceu?”, vale perguntar: o que eu posso fazer para garantir que aquilo realmente importante continue na mesa?
Se a conversa começou com uma mesa vazia, o truque não é tentar colocar tudo sobre ela.
É garantir que, quando chegar a hora de trabalhar, os papéis que realmente importam estejam sempre por cima.
