← cd ..
ia

Context window: o motivo real de a IA 'esquecer' o que você disse

Quando um modelo de IA "esquece" algo que você disse cinco mensagens atrás, o problema quase nunca é falta de inteligência — é limite de context window.

O que é, na prática

Context window é a quantidade de texto (medida em tokens, pedaços de palavra) que o modelo consegue "ver" de uma vez ao gerar uma resposta. Tudo que passa desse limite simplesmente não existe mais pra ele naquele momento — não é memória de longo prazo, é uma janela fixa que se move junto com a conversa.

Por que janelas maiores não resolvem tudo

Modelos atuais já operam com janelas de centenas de milhares de tokens — o suficiente pra um livro inteiro. Mas janela grande não é sinônimo de uso eficiente: modelos tendem a dar peso desigual ao conteúdo dependendo de onde ele está na janela (informação no meio às vezes recebe menos atenção que no início ou fim). Context window grande resolve "cabe", não resolve "é usado bem".

Como isso muda a forma de usar IA no trabalho

Três práticas que ajudam:

  • Reforçar o essencial perto do fim da conversa, não só no começo.
  • Resumir e recomeçar quando a conversa fica longa, em vez de deixar acumular.
  • Separar contexto persistente de contexto de tarefa — instruções fixas (como estilo de código, convenções) valem mais em um arquivo de configuração persistente do que repetidas em cada prompt.

O ponto prático

Se a IA "esqueceu" algo, a pergunta certa não é "por que ela é burra" — é "isso ainda está dentro da janela de contexto, e está posicionado de um jeito que o modelo consegue usar bem".