شهد الحسني | مأمني الإبداعيه
عندما يقرأ الإنسان جملة، فإنه لا ينظر إلى كل كلمة بشكل منفصل، بل يستفيد من الكلمات السابقة لفهم الكلمة الحالية. وهنا تظهر أهمية الشبكات العصبية المتكررة RNN.
صُممت RNN للتعامل مع البيانات المتسلسلة، حيث يمكن للمعلومات السابقة أن تؤثر في النتيجة الحالية. فعند معالجة كلمة في جملة، تستفيد الشبكة من المعلومات التي احتفظت بها من الكلمات السابقة من خلال ما يسمى Hidden State.
لكن المشكلة أن تذكر المعلومات لفترة طويلة قد يكون صعبًا على RNN، خصوصًا عندما تكون المعلومة المهمة بعيدة عن الجزء الذي تتم معالجته حاليًا. هذه المشكلة تُعرف باسم Vanishing Gradient.
🔐 وهنا يأتي دور LSTM
ظهرت LSTM كنوع متطور من RNN لمعالجة مشكلة الذاكرة طويلة المدى. تحتوي LSTM على آلية من البوابات تساعدها على تحديد المعلومات التي يجب الاحتفاظ بها والمعلومات التي يمكن تجاهلها.
بشكل مبسط، يمكن تخيلها كأنها ذاكرة ذكية تقول:
هذه المعلومة مهمة، احتفظ بها.
هذه المعلومة لم تعد مهمة، تجاهلها.
استخدمت LSTM في العديد من التطبيقات مثل التعرف على الكلام، الترجمة وتحليل البيانات الزمنية. ومع تطور الذكاء الاصطناعي ظهرت Transformers التي أصبحت أكثر استخدامًا في كثير من مهام معالجة اللغة الحديثة.
✨ الخلاصة
يمكن تلخيص الفكرة كالتالي:
RNN → تتعامل مع التسلسل والذاكرة السابقة
⬇️
ظهرت مشكلة تذكر المعلومات القديمة
⬇️
LSTM → تساعد على الاحتفاظ بالمعلومات المهمة لفترة أطول
⬇️
Transformers → قدمت طريقة أكثر كفاءة للتعامل مع العلاقات بين أجزاء التسلسل