Memória Híbrida
Memória Híbrida refere-se a uma abordagem arquitetônica em IA e grandes modelos de linguagem (LLMs) onde múltiplos tipos distintos de armazenamento de memória são integrados e utilizados simultaneamente. Em vez de depender de um único banco de dados ou janela de contexto, um sistema híbrido combina estrategicamente memória rápida e volátil (como RAM ou cache) com armazenamento persistente mais lento (como bancos de dados vetoriais ou bancos de dados tradicionais SQL/NoSQL).
Em aplicações complexas de IA, o volume e a variedade de informações necessárias frequentemente excedem a capacidade de um único componente de memória. A memória híbrida resolve o trade-off entre velocidade e escala. Ela permite que os modelos acessem contexto imediato e altamente relevante instantaneamente, ao mesmo tempo em que retêm vastas quantidades de conhecimento histórico de longo prazo para um raciocínio mais profundo.
O sistema opera roteando as solicitações de informação para a camada de memória mais apropriada. O contexto conversacional de curto prazo e imediato é tipicamente mantido em memória volátil de alta velocidade. Para recuperar fatos específicos ou interações passadas, o sistema consulta uma base de conhecimento especializada, frequentemente um banco de dados vetorial, que armazena embeddings de dados passados. Dados estruturados de longo prazo podem residir em um banco de dados relacional, acessado por meio de um pipeline de geração aumentada por recuperação (RAG).