العودة إلى العرض التقديمي

الذكاء الاصطناعي الجماعي والأنظمة المستقلة والطائرات بدون طيار

تتناول هذه المحاضرة ذكاء السرب الاصطناعي للأنظمة الروبوتية المستقلة وشبه المستقلة، مع تركيز خاص على الطائرات بدون طيار. وتعرض فكرة أن السلوك الجماعي المعقد والمرن يمكن أن ينشأ من تعاون عدد كبير من وكلاء الذكاء الاصطناعي البسطاء نسبيا، مستفيدة من أمثلة ذكاء السرب في الطبيعة والسلوك الناشئ والتطور البيولوجي. ثم توضح تصميما لـ Swarm AI يتم تدريبه باستخدام التعلم المعزز العميق المعدل والتحسين التطوري، قبل عرض محاكاة للبحث الشبكي وسلسلة اتصالات ذاتية الشفاء وثلاثة أشكال من هجمات السرب المستقلة والمنسقة.

عرض الشرائح 17–24 / 34

Slide 17

كيف يمكنك تدريب كلب

Slide 17 · 26:26

يشرح مثال تدريب كلب على جلب شيء دورة التعلم المعزز الأساسية. يراقب الوكيل البيئة ويختار فعلا ويتلقى مكافأة عند تنفيذ السلوك المطلوب، فيتعلم تدريجيا الأفعال التي تؤدي إلى نتائج ناجحة.

Slide 18

التعلم المعزز العميق

Slide 18 · 27:27

يطبق التعلم المعزز العميق المبدأ نفسه باستخدام شبكة عصبية اصطناعية لتمثيل سياسة الوكيل. وتتحول معلومات الحالة والحساسات إلى أفعال، بينما توجه المكافآت الرقمية عملية التدريب نحو الأفعال ذات المكافأة المستقبلية المتوقعة الأعلى.

Slide 19

التعلم المعزز العميق: روبوت ثنائي الأبعاد يتعلم المشي

Slide 19 · 28:45

يوضح مثال Bipedal Walker ثنائي الأبعاد التعلم المعزز العميق باستخدام PPO، وهو خوارزمية من نوع actor-critic. تختار شبكة السياسة حركات الروبوت، بينما تقدر شبكة القيمة المكافآت المستقبلية، وتتحسن الشبكتان من خلال التفاعل المتكرر مع البيئة المحاكاة.

Slide 20

مشكلة في الأنظمة متعددة الوكلاء

Slide 20 · 31:24

قد يفشل التعلم المعزز متعدد الوكلاء إذا كوفئ كل وكيل على نجاحه الفردي فقط. ويوضح تشبيه فريق كرة القدم ضرورة تشجيع الأداء الجماعي أثناء التدريب؛ ويستخدم النهج هنا تشكيل المكافآت وعوامل التعاون لتحقيق ذلك.

Slide 21

أمثلة محاكاة للذكاء الاصطناعي الجماعي

Slide 21 · 33:11

يقدم قسم المحاكاة خمسة أمثلة: الباحث الشبكي، وسلسلة ديناميكية لمكررات اتصالات الطائرات بدون طيار، وثلاثة هجمات سرب مستقلة. وتوضح الأمثلة البحث شبه العشوائي والمرونة وتنسيق الهجمات والمزامنة والتعاون بين أنواع مختلفة من الوكلاء.

Slide 22

الباحث الشبكي

Slide 22 · 34:23

يستخدم الباحث الشبكي عشرة وكلاء بسطاء يشبهون النمل لاستكشاف شبكة 100 في 100 خلال 1000 خطوة زمنية. ولا يملكون سوى حساسات قرب محلية، من دون معلومات عن الموقع أو خريطة أو ذاكرة أو اتصالات، مما يجعل مهمة البحث صعبة عمدا.

Slide 23

محاكاة الباحث الشبكي

Slide 23 · 36:13

رغم القيود الشديدة، يغطي وكلاء الباحث الشبكي عادة نحو 60 إلى 70 بالمئة من الشبكة. وتستفيد حركتهم التي تبدو غير منظمة من السلوك شبه العشوائي بصورة بناءة، مما يوضح أن استراتيجية السرب المتعلمة والفعالة قد لا تكون مفهومة حدسيا للمراقب البشري.

Slide 24

مكررات السرب

Slide 24 · 37:50

يُكلف سرب من الطائرات المستقلة بالحفاظ على سلسلة اتصالات ديناميكية بين طيار بشري وطائرة هجومية متحركة. ويجب على طائرات التكرار إعادة تموضعها باستمرار مع حركة الطائرة الهجومية، مع تعويض الخسائر الناتجة عن نيران العدو.