الاستكشاف بدافع جوهري باستخدام الفضاء الكامن للفعل والنتيجة
| العنوان | الاستكشاف بدافع جوهري باستخدام الفضاء الكامن للفعل والنتيجة |
|---|---|
| المؤلف | سينر، إم آي، ناجاي، واي، أوزتوب، إرهان، أوغور، إي. |
| تاريخ النشر: | 2023-06 |
| مكان النشر | - IEEE |
| الموضوع | الروبوتات التنموية، التنبؤ بالتأثير، التحفيز الداخلي (IM)، التعلم المفتوح، التعلم التمثيلي |
| النوع | دورية |
| اللغة | الإنجليزية |
| رقمي | نعم |
| مخطوط | لا |
| المكتبة: | جامعة اوزيجين |
| معرف أصل المكتبة | 2379-8920 |
| رقم السجل | 18b3ac6d-61cb-41c5-904f-ba8c0aa5c755 |
| موقع المكتبة | علوم الكمبيوتر |
| التاريخ | 2023-06 |
| نص عينة | أحد الأساليب الفعالة لتزويد العوامل الاصطناعية بالمهارات الحسية الحركية هو استخدام الاستكشاف الذاتي. للقيام بذلك بكفاءة أمر بالغ الأهمية، حيث أن الوقت وجمع البيانات مكلفان. في هذه الدراسة، نقترح آلية استكشاف تمزج بين تمثيلات الفعل والأشياء ونتائج الفعل في مساحة كامنة، حيث يتم تشكيل المناطق المحلية لاستضافة التعلم النموذجي المتقدم. يستخدم الوكيل الدافع الجوهري لاختيار النموذج المتقدم الذي يتمتع بأعلى تقدم في التعلم لاعتماده في خطوة استكشاف معينة. وهذا يوازي كيفية تعلم الأطفال الرضع، حيث يشير التقدم العالي في التعلم إلى أن مشكلة التعلم ليست سهلة للغاية ولا صعبة للغاية في المنطقة المختارة. يتم التحقق من صحة النهج المقترح باستخدام روبوت محاكي في بيئة سطح الطاولة. يتكون مشهد المحاكاة من روبوت وأشياء مختلفة، حيث يتفاعل الروبوت مع واحد منهم في كل مرة باستخدام مجموعة من الإجراءات ذات المعلمات ويتعلم نتائج هذه التفاعلات. من خلال النهج المقترح، ينظم الروبوت منهجه التعليمي كما هو الحال في مناهج التحفيز الجوهري الحالية ويتفوق عليها في سرعة التعلم. علاوة على ذلك، يُظهر نظام التعلم ميزات تتوافق جزئيًا مع نمو الرضيع؛ وعلى وجه الخصوص، يتعلم النظام المقترح التنبؤ بنتائج المهارات المختلفة بطريقة مرحلية. |
| DOI | 10.1109/TCDS.2021.3062728 |
| Cilt | 15 |