آلية الانتباه
آلية الانتباه (Attention Mechanism) هي تقنية تسمح لشبكة عصبية اصطناعية بوزن أهمية أجزاء مختلفة من بيانات الإدخال بشكل ديناميكي عند إنتاج مخرج. فبدلاً من معاملة جميع عناصر الإدخال بالتساوي، يمكّن الانتباه النموذج من التركيز بشكل انتقائي على المعلومات الأكثر صلة من تسلسل الإدخال في كل خطوة من خطوات المعالجة.
غالباً ما واجهت الشبكات العصبية المتكررة التقليدية (RNNs) صعوبة في التعامل مع التبعيات طويلة المدى، وعانت من اختناق المعلومات كلما طالت التسلسلات. تعالج آلية الانتباه هذا القيد بشكل مباشر. من خلال توفير تركيز مرجح، تسمح النماذج بالحفاظ على السياق عبر كميات هائلة من البيانات، مما يؤدي إلى تحسين كبير في الأداء في المهام المعقدة مثل الترجمة وتلخيص النصوص.
في جوهرها، تقوم آلية الانتباه بحساب مجموعة من الأوزان. بالنسبة لعنصر إخراج معين، تحسب الآلية درجة تشير إلى مدى صلة كل عنصر إدخال. يتم تطبيع هذه الدرجات (غالباً باستخدام دالة softmax) لإنشاء أوزان الانتباه. تُستخدم هذه الأوزان بعد ذلك لحساب مجموع مرجح لقيم الإدخال، مما ينتج عنه متجه سياقي ذو صلة عالية بالمهمة الحالية.
تُعد هذه الآلية أساسية لهندسات الذكاء الاصطناعي الحديثة:
تشمل المزايا الأساسية لتطبيق الانتباه ما يلي:
على الرغم من قوتها، تطرح آليات الانتباه تحديات:
تشمل المفاهيم الرئيسية المرتبطة ارتباطاً وثيقاً بالانتباه المحولات (Transformers) (الهندسة المعمارية المبنية بالكامل حول الانتباه)، والانتباه الذاتي (Self-Attention) (حيث ينتبه المدخل إلى نفسه)، وهياكل المُشفِّر-المُفكِّك (Encoder-Decoder).