نمذجة تطور تقليد الرضع باستخدام التعلم المعزز العكسي

العنوان نمذجة تطور تقليد الرضع باستخدام التعلم المعزز العكسي
المؤلف تيكدين، A. E.، أوغور، E.، ناجاي، Y.، أوزتوب، إرهان
تاريخ النشر: 2018-09
مكان النشر - IEEE
الموضوع المراقبون، تحليل المهام، التعلم المعزز، المسار، أنظمة استشعار الروبوت، الإنتروبيا
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة: جامعة اوزيجين
معرف أصل المكتبة 978-1-5386-6110-9
رقم السجل 58ce4895-8832-4696-a6a2-f0b50713761d
موقع المكتبة علوم الكمبيوتر
التاريخ 2018-09
ملاحظات مشروع بدء تشغيل صندوق بوغازيجي للأبحاث (BAP) ؛ منحة التعاون الثنائي بين سلوفينيا/ARRS-تركيا/TUBITAK (مشروع ARRS)؛ توبيتاك ; JST CREST الانعكاس المعرفي، اليابان
نص عينة لا يُعرف سوى القليل عن الآليات الحسابية لكيفية تطور مهارات التقليد جنبًا إلى جنب مع التعلم الحسي الحركي لدى الأطفال. في مجال الروبوتات، هناك عدة أطر متطورة للتعلم بالتقليد أو ما يسمى بالتعلم عن طريق العرض. يهيمن نموذجان: التعلم المباشر (DL) والتعلم المعزز العكسي (IRL). الأول هو آلية بسيطة حيث ترتبط الحالة المرصودة وأزواج العمل لبناء نسخة من سياسة العمل الخاصة بالمتظاهر. في الأخير، يتم البحث عن مبدأ الأمثلية أو هيكل المكافأة الذي من شأنه أن يفسر السلوك الملاحظ باعتباره الحل الأمثل الذي يحكمه مبدأ الأمثلية أو وظيفة المكافأة الموجودة. في هذه الدراسة، نستكشف مدى معقولية ما إذا كان شكل ما من أشكال آلية IRL عند الرضع يمكن أن يسهل تعلم التقليد وفهم سلوكيات الآخرين. نقترح أن يقوم الأطفال بإسقاط الأحداث التي تجري في البيئة من خلال تمثيلاتهم الداخلية من خلال مجموعة من الميزات التي تتطور أثناء النمو. نقوم بتنفيذ هذه الفكرة على بيئة عالمية شبكية، والتي يمكن اعتبارها نموذجًا بسيطًا للوصول مع تجنب العوائق. يجب على الرضيع الملاحظ تقليد سلوك الوصول إلى المتظاهر من خلال IRL باستخدام مجموعة متنوعة من الميزات التي تتوافق مع مراحل مختلفة من التطور. تشير نتائج المحاكاة لدينا إلى أن تغيير أداء الشكل U أثناء تطور التقليد الملحوظ عند الرضع يمكن إعادة إنتاجه باستخدام النموذج المقترح.
DOI 10.1109/DEVLRN.2018.8761045
عرض في المصدر جامعة اوزيجين جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات
جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات جامعة اوزيجين

نمذجة تطور تقليد الرضع باستخدام التعلم المعزز العكسي

المؤلف تيكدين، A. E.، أوغور، E.، ناجاي، Y.، أوزتوب، إرهان
تاريخ النشر 2018-09
مكان النشر - IEEE
الموضوع المراقبون، تحليل المهام، التعلم المعزز، المسار، أنظمة استشعار الروبوت، الإنتروبيا
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة جامعة اوزيجين
معرف أصل المكتبة 978-1-5386-6110-9
رقم السجل 58ce4895-8832-4696-a6a2-f0b50713761d
موقع المكتبة علوم الكمبيوتر
التاريخ 2018-09
ملاحظات مشروع بدء تشغيل صندوق بوغازيجي للأبحاث (BAP) ؛ منحة التعاون الثنائي بين سلوفينيا/ARRS-تركيا/TUBITAK (مشروع ARRS)؛ توبيتاك ; JST CREST الانعكاس المعرفي، اليابان
نص عينة لا يُعرف سوى القليل عن الآليات الحسابية لكيفية تطور مهارات التقليد جنبًا إلى جنب مع التعلم الحسي الحركي لدى الأطفال. في مجال الروبوتات، هناك عدة أطر متطورة للتعلم بالتقليد أو ما يسمى بالتعلم عن طريق العرض. يهيمن نموذجان: التعلم المباشر (DL) والتعلم المعزز العكسي (IRL). الأول هو آلية بسيطة حيث ترتبط الحالة المرصودة وأزواج العمل لبناء نسخة من سياسة العمل الخاصة بالمتظاهر. في الأخير، يتم البحث عن مبدأ الأمثلية أو هيكل المكافأة الذي من شأنه أن يفسر السلوك الملاحظ باعتباره الحل الأمثل الذي يحكمه مبدأ الأمثلية أو وظيفة المكافأة الموجودة. في هذه الدراسة، نستكشف مدى معقولية ما إذا كان شكل ما من أشكال آلية IRL عند الرضع يمكن أن يسهل تعلم التقليد وفهم سلوكيات الآخرين. نقترح أن يقوم الأطفال بإسقاط الأحداث التي تجري في البيئة من خلال تمثيلاتهم الداخلية من خلال مجموعة من الميزات التي تتطور أثناء النمو. نقوم بتنفيذ هذه الفكرة على بيئة عالمية شبكية، والتي يمكن اعتبارها نموذجًا بسيطًا للوصول مع تجنب العوائق. يجب على الرضيع الملاحظ تقليد سلوك الوصول إلى المتظاهر من خلال IRL باستخدام مجموعة متنوعة من الميزات التي تتوافق مع مراحل مختلفة من التطور. تشير نتائج المحاكاة لدينا إلى أن تغيير أداء الشكل U أثناء تطور التقليد الملحوظ عند الرضع يمكن إعادة إنتاجه باستخدام النموذج المقترح.
DOI 10.1109/DEVLRN.2018.8761045
جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات
جامعة اوزيجين يتم إعادة توجيهك...

يرجى الانتظار