Por que a IA não leu meu processo inteiro? A janela de contexto é a sua mesa
Porque toda ferramenta de IA tem uma mesa de tamanho limitado, a janela de contexto, e só responde com o que está nela: arquivo, conversa e respostas anteriores. Quando a mesa enche, parte do que você mandou fica de fora, e a resposta não avisa. O tamanho muda a cada versão; o limite existe sempre. Trabalhe em lotes.
Neste artigo (6 seções)
A ferramenta não leu, e a culpa não é sua
Você subiu um processo de centenas de páginas, pediu uma análise e recebeu um texto bonito que ignorou a perícia, que estava lá pelo meio. Ou você estava numa conversa longa, explicou o caso com calma no começo, e vinte mensagens depois a ferramenta respondeu como se nunca tivesse ouvido falar dele.
Nas duas situações a reação é a mesma: “essa ferramenta é ruim” ou “eu não sei usar isso”. Quase sempre não é nem uma coisa nem outra. É um limite que existe em toda ferramenta de IA, tem nome, e ninguém te explicou.
A janela de contexto é a sua mesa
Pensa na sua mesa de trabalho. Você só consegue trabalhar com o que está em cima dela: o processo aberto, o bloco de anotação, o contrato do lado. O que está na estante, na gaveta ou no arquivo do escritório existe, mas não está ao seu alcance enquanto você escreve.
A janela de contexto é isso: tudo o que cabe em cima da mesa da ferramenta na hora em que ela escreve a resposta. E na mesa dela vai tudo: o arquivo que você subiu, cada mensagem que você mandou, cada resposta que ela deu, e a resposta que ela está escrevendo agora. Uma conversa longa é uma mesa que vai enchendo sozinha, mesmo sem arquivo novo.
A mesa dela é grande, muito maior do que a sua. Mas tem borda. E o que você precisa entender é que ela mede o espaço em pedaços de palavra, chamados tokens, não em páginas. Um processo digitalizado, uma tabela, um anexo cheio de carimbo: cada um ocupa um espaço diferente na mesa, e você não vê a conta.
O que acontece quando a mesa enche
Duas coisas, dependendo da ferramenta. Ou ela recusa o pedido e avisa que o material é grande demais, o que é o cenário bom, porque você fica sabendo. Ou ela tira alguma coisa da mesa para caber: descarta o começo da conversa, resume o que veio antes, deixa parte do arquivo fora. E aí vem o problema: a resposta não avisa. Ela sai inteira, bem escrita, com começo, meio e fim, e o pedaço que ficou fora da mesa simplesmente não existe para ela.
É por isso que a análise pulou a perícia. Não foi preguiça. A perícia não estava na mesa.
Tem uma segunda parte, menos intuitiva. Mesmo antes de encher, mesa lotada rende pior. O próprio fabricante documenta: quanto mais coisa há no contexto, mais a precisão e a capacidade de encontrar um detalhe caem. Mais mesa não é automaticamente melhor. Mesa arrumada é.
Trabalhe em lotes
Se o limite existe em toda ferramenta, o método não pode depender de a ferramenta ser grande. Ele depende de você dividir.
Divida o processo em partes que façam sentido: a fase de conhecimento, a instrução, os recursos. Ou por volume: a cada tantas páginas. Para cada parte, peça um índice com fatos, teses, pedidos e prazos, cada um com o número da página. O índice com página é o seu detector: se ele salta da página 40 para a 190 sem um item, aquele trecho não estava na mesa. O pedido inteiro está em não peça resumo do processo, peça o índice.
Depois, junte os índices e faça a análise a partir deles, numa conversa nova. Conversa nova é mesa limpa. Cada tarefa merece a sua.
E coloque na mesa primeiro o que importa. Se a pergunta é sobre a perícia, suba a perícia e as peças que discutem a perícia, não o processo inteiro. O que não está na mesa não existe para a ferramenta, mas o que está na mesa sem precisar só atrapalha.
Testado em setembro de 2026, com Claude e Gemini Notebook, conforme a documentação de cada fornecedor: a Anthropic define a janela de contexto como todo o texto que o modelo pode consultar ao gerar uma resposta, incluindo a própria resposta, uma “memória de trabalho”; explica que cada mensagem e cada resposta se acumulam na janela ao longo da conversa; diz que, conforme o volume de tokens cresce, a precisão e a capacidade de recuperar informação degradam, e que o chat do claude.ai pode administrar a janela descartando o que entrou primeiro, e, na API, a Anthropic documenta um recurso de compactação que resume o começo da conversa para ela poder continuar. Nesta data, a documentação lista janela de 1 milhão de tokens para os modelos atuais do Claude e 200 mil para outros. No Gemini Notebook (antes NotebookLM), a lógica é outra: é uma prateleira, não uma mesa. O Google diz que ele responde só com base nas fontes que você subiu e não responde se a resposta não está nelas; cada fonte pode ter até 500 mil palavras, e o caderno gratuito aceita até 50 fontes. O retrato atual de cada ferramenta fica na página /ferramentas.
O tamanho muda, o limite não
Daqui a seis meses os números da caixa acima vão estar velhos. As mesas crescem a cada versão, e alguém sempre vai anunciar a ferramenta que “lê o processo inteiro”. Pode ser verdade para o seu processo de hoje. O limite continua lá, um pouco mais longe, e a regra da mesa lotada continua valendo.
O que não envelhece é o método: dividir, pedir índice com página, uma conversa por tarefa, o essencial primeiro. Quem trabalha assim não depende de a ferramenta ser grande. E quem depende de a ferramenta ser grande descobre o limite no dia em que a perícia fica de fora.
Na prática
- Pegue o maior processo que você tem e divida em três ou quatro partes com sentido: conhecimento, instrução, recursos.
- Para cada parte, peça o índice com número de página. Onde o índice pular páginas, divida de novo.
- Junte os índices numa conversa nova e faça a análise a partir deles, com as páginas ao lado para conferir.
- Antes de subir qualquer coisa, pergunte: o que a tarefa precisa? Suba isso, não a pasta inteira.
- Quando a ferramenta “esquecer” o começo, não brigue com ela. Abra uma conversa nova e coloque na mesa o que a tarefa exige.
Fontes
- Anthropic, documentação oficial: Context windows (definição, acúmulo por turno, degradação com o volume, compactação e tamanhos por modelo) (platform.claude.com)
- Google, Central de Ajuda do Gemini Notebook (NotebookLM): perguntas frequentes (limite por fonte e respostas restritas às fontes) (support.google.com)
- Google, Central de Ajuda do Gemini Notebook (NotebookLM): planos e limites (fontes por caderno) (support.google.com)
Esta ideia apareceu primeiro em uma aula aberta sobre como ler documentos longos com IA, em 26 de agosto de 2026.
Achou útil? Mande para alguém.
Compartilhar no WhatsAppCompartilhar no LinkedIn