دليل الأساسيات

الشبكات العصبية المتكررة

تم تصميم الشبكات العصبية المتكررة (RNNs) للتعامل مع تسلسلات مثل النص والكلام والسلاسل الزمنية.

قراءة لمدة دقيقتينآخر تحديث

نظرة عامة

They process data one step at a time while carrying a memory of what came before, making order and context matter.

الغوص العميق

على عكس الشبكة القياسية التي ترى جميع المدخلات في وقت واحد، تقرأ RNN التسلسل خطوة بخطوة، وتغذي مخرجاتها من الخطوة السابقة إلى نفسها. تخلق هذه الحلقة حالة مخفية، وهي عبارة عن ملخص مستمر لكل ما تمت مشاهدته حتى الآن، لذلك يمكن تفسير كلمة "بنك" بشكل مختلف بعد كلمة "نهر" عنها بعد كلمة "توفير". تعاني شبكات RNN البسيطة من التسلسلات الطويلة لأن التدرجات تتقلص أو تنفجر أثناء التدريب، مما يجعلها تنسى السياق البعيد. أصلحت المتغيرات المسورة هذا: تستخدم الذاكرة الطويلة قصيرة المدى (LSTM، 1997) والوحدة المتكررة المسورة (GRU) البوابات التي تقرر ما يجب الاحتفاظ به أو تحديثه أو التخلص منه، مما يسمح للشبكة بالاحتفاظ بالمعلومات عبر العديد من الخطوات. قامت شبكات RNN بدعم الترجمة الآلية المبكرة والتعرف على الكلام والنص التنبؤي قبل أن تحل محلها Transformers إلى حد كبير.

البصيرة الفنية

السمة المميزة هي حلقة ردود الفعل: في كل مرة تقوم الشبكة بدمج المدخلات الحالية مع الحالة المخفية السابقة لإنتاج حالة مخفية جديدة. يستخدم التدريب الانتشار العكسي عبر الزمن، والذي يؤدي إلى فتح الحلقة عبر جميع الخطوات ونشر الخطأ إلى الخلف. هذا هو المكان الذي تبرز فيه مشكلة تلاشي التدرج، نظرًا لأن التدرجات المتضاعفة عبر العديد من الخطوات تتجه نحو الصفر. تضيف LSTMs حالة خلية منفصلة وبوابات الإدخال والنسيان والإخراج حتى تتمكن المعلومات من التدفق عبر فترات طويلة دون تغيير تقريبًا.

التأثير الاستراتيجي

قرارات أوضح

يساعدك على فصل المطالبات الفنية الواضحة عن لغة التسويق.

التكلفة والميزانية

يمكنك طرح أسئلة تنفيذ أفضل قبل إنفاق المال أو الوقت.

الفريق وسير العمل

تتخذ الفرق ذات الفهم المشترك قرارات أفضل بشأن المنتجات والسياسات والتعلم.

مستقبل الشبكات العصبية المتكررة

لقد تفوقت المحولات على شبكات RNN في معظم المهام اللغوية واسعة النطاق لأنها تعالج التسلسلات بالتوازي وتلتقط الروابط طويلة المدى بشكل أفضل. ومع ذلك، فإن شبكات RNN ليست قديمة على الإطلاق: فمعالجتها للذاكرة الثابتة خطوة بخطوة تناسب تدفق الصوت، والأجهزة منخفضة الطاقة، والتحكم في الوقت الفعلي. تعمل نماذج فضاء الدولة الأحدث مثل Mamba على إحياء أفكار نمط التكرار بكفاءة حديثة، والتعامل مع التسلسلات الطويلة جدًا بتكلفة زهيدة. توقع الأساليب المتكررة ومساحة الحالة للحفاظ على مكانة قوية أينما تصل البيانات بشكل مستمر أو عندما تكون الحوسبة والذاكرة ضيقة.

التنفيذ في العالم الحقيقي

التشغيل المبكر لأنظمة Google للترجمة وتحويل الكلام إلى نص

توقع الكلمة التالية في الإكمال التلقائي للوحة مفاتيح الهاتف الذكي والكتابة بالتمرير السريع

التنبؤ بأسعار الأسهم والطلب على الطاقة والطقس من بيانات السلاسل الزمنية التاريخية

توليد وتحليل الموسيقى أو اكتشاف الحالات الشاذة في تدفق بيانات الاستشعار

المخاطر والدرابزين

قد تستخدم الفرق المختلفة نفس المصطلح بشكل مختلف، لذا حدد النطاق مبكرًا.

يمكن أن تبدو المعايير قوية بينما يكون الأداء في العالم الحقيقي غير متساوٍ.

غالبًا ما يؤدي تجاهل جودة البيانات وخطط التقييم إلى نتائج هشة.

خارطة طريق التنفيذ

1

ابدأ بتعريف لغة واضحة للنتيجة التي تحتاجها.

2

اختر مقياس نجاح واحد وحالة فشل واحدة قبل الاختبار.

3

قم بتشغيل برنامج تجريبي صغير يحتوي على بيانات تمثيلية، وليس مجموعة تجريبية مصقولة.

4

قم بالتوثيق حيث تساعد الشبكات العصبية المتكررة وأين تكون الطرق الأبسط أفضل.

استمر في الاستكشاف

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Recurrent Neural Networks quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

ابدأ الاختبار

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

الدليل التالي

الرسم البياني للشبكات العصبية

الأسئلة المتداولة

What is Recurrent Neural Networks?

تم تصميم الشبكات العصبية المتكررة (RNNs) للتعامل مع تسلسلات مثل النص والكلام والسلاسل الزمنية. إنهم يعالجون البيانات خطوة بخطوة مع الاحتفاظ بذاكرة لما حدث من قبل، مما يجعل النظام والسياق مهمين.

ما الذي يجعل شبكة RNN مختلفة عن شبكة التغذية الأمامية القياسية؟

تحتوي شبكة RNN على حلقة تغذية مرتدة: يتم تمرير الحالة المخفية لكل خطوة للأمام، مما يمنح الشبكة ذاكرة للأجزاء السابقة من التسلسل.

ما هي "الحالة المخفية" في RNN؟

تعمل الحالة المخفية كذاكرة الشبكة، ويتم تحديثها في كل خطوة لتلخيص التسلسل الذي تمت معالجته حتى تلك النقطة.

ما المشكلة التي تجعل شبكات RNN البسيطة تنسى المعلومات من بعيد في تسلسل؟

عندما تتضاعف التدرجات عبر العديد من الخطوات الزمنية، فإنها تميل إلى الانكماش نحو الصفر (أو الانفجار)، لذلك تتوقف المعلومات المبكرة عن التأثير على التعلم.

كيف يمكن تحسين LSTMs وGRUs على شبكات RNN البسيطة؟

تتعلم الوحدات المسورة مثل LSTM وGRU تنظيم تدفق المعلومات، مما يسمح للسياق المفيد بالاستمرار عبر تسلسلات طويلة وتقليل مشكلة التدرج التلاشي.

ما نوع البيانات التي تم تصميم شبكات RNN خصيصًا لها؟

تتألق شبكات RNN على البيانات المرتبة حيث يكون السياق والتسلسل مهمًا، مثل الجمل والتدفقات الصوتية والقياسات بمرور الوقت.