"A memória da IA não é infinita. Ela é um quadro branco que precisa ser apagado para caber mais coisas."
Entrada (Input)
Inclui sua pergunta atual e todo o histórico da conversa anterior.
Limite (Tokens)
Cada modelo tem um limite máximo (ex: 4.000 ou 128.000 tokens).
Esquecimento
Quando o limite é atingido, o início da conversa é "cortado" para caber o novo.
A Analogia do "Quadro Branco"
Imagine que a IA é um gênio, mas que tem uma memória de peixinho dourado. O "Contexto" é um quadro branco na frente dela. Tudo o que você conversa é escrito lá. Enquanto houver espaço, ela lembra de tudo. Quando o quadro enche, para escrever uma nova frase, ela precisa apagar a primeira frase lá do topo. Se a informação importante (como seu nome ou o tema do projeto) foi apagada, ela não sabe mais do que você está falando.