مسترجع بزمن انتقال منخفض
المُسترجِع منخفض الكمون (Low-Latency Retriever) هو مكون ضمن نظام ذكاء اصطناعي أو نظام بحث، مصمم لجلب معلومات عالية الصلة أو مقتطفات بيانات من قاعدة معرفية ضخمة بأقل قدر من التأخير. تتمثل وظيفته الأساسية في سد الفجوة بين استعلام المستخدم والسياق الضروري الذي يحتاجه نموذج توليدي (مثل نموذج اللغة الكبير LLM) لإنتاج استجابة دقيقة وفي الوقت المناسب.
في تطبيقات الذكاء الاصطناعي التفاعلية الحديثة، تعد السرعة بنفس أهمية الدقة. يؤدي الكمون العالي إلى إحباط المستخدمين وتدهور الجودة المتصورة للخدمة. يضمن المُسترجِع منخفض الكمون أن يتم تقديم السياق للنموذج اللاحق بشكل فوري تقريباً، مما يتيح الذكاء الاصطناعي المحادثاتي في الوقت الفعلي، ونتائج البحث الفورية، ودعم اتخاذ القرار الفوري.
تعتمد هذه الأنظمة عادةً على الفهرسة المتقدمة وقواعد بيانات المتجهات (Vector Databases). عندما يصل استعلام، يقوم المُسترجِع بتحويل الاستعلام إلى متجه رقمي (تضمين - embedding). ثم يجري بحثاً عالي السرعة عن أقرب الجيران (nearest-neighbor search) مقابل مجموعة مُفهرسة مسبقاً من متجهات المستندات. تُستخدم تقنيات مثل خوارزميات أقرب جار تقريبي (Approximate Nearest Neighbor - ANN) لتحقيق التوازن بين سرعة البحث ودقة الاسترجاع، مما يضمن العثور على التطابقات الأقرب بسرعة.