Janela de Contexto
A janela de contexto refere-se à quantidade máxima de texto de entrada (prompt) e texto de saída (completude) que um modelo de linguagem grande (LLM) pode processar ou "lembrar" durante uma única interação. Essa capacidade é medida em tokens, onde um token é aproximadamente equivalente a uma palavra ou a uma unidade de subpalavra.
O tamanho da janela de contexto dita diretamente a complexidade e o escopo das tarefas que um LLM pode lidar. Uma janela maior permite que o modelo mantenha a coerência em conversas muito mais longas, analise documentos extensos e faça referência a partes anteriores de uma entrada complexa sem perder o fio da meada geral.
Os modelos baseados em Transformer, que alimentam a maioria dos LLMs modernos, processam informações sequencialmente dentro desse limite de tokens definido. Quando a entrada excede a janela de contexto, o modelo deve truncar as informações mais antigas, fazendo com que ele efetivamente "esqueça" o início da conversa ou do documento.