اتخاذ القرار المتسلسل بناءً على العاطفة الناشئة للروبوت البشري

العنوان اتخاذ القرار المتسلسل بناءً على العاطفة الناشئة للروبوت البشري
المؤلف كيرتاي، إم، فانوتشي، إل.، فالوتيكو، إي.، أوزتوب، إرهان، لاشي، سي.
تاريخ النشر: 2017
مكان النشر - IEEE
الموضوع الروبوتات، التصور، اتخاذ القرار، الخوارزميات الإرشادية، استهلاك الطاقة، علم الأحياء، الكاميرات
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة: جامعة اوزيجين
معرف أصل المكتبة 2164-0580
رقم السجل 7d47f7a3-3da7-4a77-aab0-3fea77900a9b
موقع المكتبة علوم الكمبيوتر
التاريخ 2017
ملاحظات المفوضية الأوروبية ; وزارة الخارجية الإيطالية، المديرية العامة لتعزيز "النظام القطري"، وحدة التعاون العلمي والتكنولوجي الثنائي والمتعدد الأطراف
نص عينة يمكن أن تكون بعض المشاعر والحالات المزاجية مظاهرًا لحسابات عصبية معقدة ومكلفة يرغب دماغنا في تجنبها. بدلاً من التوصل إلى قرار أمثل بناءً على الحقائق، نجد أنه من الأسهل في كثير من الأحيان، وفي بعض الأحيان أكثر فائدة، الاعتماد على الحدس. في هذا العمل، قمنا بتوسيع نموذج تم تطويره مسبقًا لمثل هذه الآلية حيث تم استخدام ذاكرة ترابطية عصبية بسيطة لتنفيذ نظام استدعاء بصري لروبوت يشبه الإنسان. في النموذج، تستهلك التغييرات في الحالة العصبية الطاقة (العصبية)، ولتقليل التكلفة الإجمالية والوقت اللازم لاستدعاء نمط الذاكرة، يجب على الروبوت اتخاذ الإجراء الذي سيؤدي إلى الحد الأدنى من تغيير الحالة العصبية. للقيام بذلك، يحتاج الروبوت إلى تعلم التصرف بعقلانية، ولهذا عليه أن يستكشف ويكتشف تكلفة أفعاله على المدى الطويل. في هذه الدراسة، يتم استخدام الروبوت البشري (iCub) للعمل في هذا السيناريو. يُعطى الروبوت الإجراء الوحيد المتمثل في تغيير اتجاه نظرته. من خلال التعلم المعزز (RL)، يتعلم الروبوت تسلسلات الحالة الزوجية التي تؤدي إلى الحد الأدنى من استهلاك الطاقة. والأهم من ذلك، أن إشارة المكافأة لـ RL لا يتم الحصول عليها من البيئة ولكن يتم الحصول عليها داخليًا، مثل التكلفة العصبية الفعلية لمعالجة المحفزات البصرية الواردة. تشير النتائج إلى أن التعلم المعزز باستخدام إشارة المكافأة المولدة داخليًا يؤدي إلى سلوكيات غير تافهة للروبوت والتي يمكن تفسيرها من قبل مراقبين خارجيين على أنها "تفضيل" الروبوت لنمط بصري معين، والذي ظهر في الواقع فقط بناءً على مبدأ تقليل التكلفة العصبية.
DOI 10.1109/HUMANOIDS.2016.7803408
عرض في المصدر جامعة اوزيجين جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات
جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات جامعة اوزيجين

اتخاذ القرار المتسلسل بناءً على العاطفة الناشئة للروبوت البشري

المؤلف كيرتاي، إم، فانوتشي، إل.، فالوتيكو، إي.، أوزتوب، إرهان، لاشي، سي.
تاريخ النشر 2017
مكان النشر - IEEE
الموضوع الروبوتات، التصور، اتخاذ القرار، الخوارزميات الإرشادية، استهلاك الطاقة، علم الأحياء، الكاميرات
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة جامعة اوزيجين
معرف أصل المكتبة 2164-0580
رقم السجل 7d47f7a3-3da7-4a77-aab0-3fea77900a9b
موقع المكتبة علوم الكمبيوتر
التاريخ 2017
ملاحظات المفوضية الأوروبية ; وزارة الخارجية الإيطالية، المديرية العامة لتعزيز "النظام القطري"، وحدة التعاون العلمي والتكنولوجي الثنائي والمتعدد الأطراف
نص عينة يمكن أن تكون بعض المشاعر والحالات المزاجية مظاهرًا لحسابات عصبية معقدة ومكلفة يرغب دماغنا في تجنبها. بدلاً من التوصل إلى قرار أمثل بناءً على الحقائق، نجد أنه من الأسهل في كثير من الأحيان، وفي بعض الأحيان أكثر فائدة، الاعتماد على الحدس. في هذا العمل، قمنا بتوسيع نموذج تم تطويره مسبقًا لمثل هذه الآلية حيث تم استخدام ذاكرة ترابطية عصبية بسيطة لتنفيذ نظام استدعاء بصري لروبوت يشبه الإنسان. في النموذج، تستهلك التغييرات في الحالة العصبية الطاقة (العصبية)، ولتقليل التكلفة الإجمالية والوقت اللازم لاستدعاء نمط الذاكرة، يجب على الروبوت اتخاذ الإجراء الذي سيؤدي إلى الحد الأدنى من تغيير الحالة العصبية. للقيام بذلك، يحتاج الروبوت إلى تعلم التصرف بعقلانية، ولهذا عليه أن يستكشف ويكتشف تكلفة أفعاله على المدى الطويل. في هذه الدراسة، يتم استخدام الروبوت البشري (iCub) للعمل في هذا السيناريو. يُعطى الروبوت الإجراء الوحيد المتمثل في تغيير اتجاه نظرته. من خلال التعلم المعزز (RL)، يتعلم الروبوت تسلسلات الحالة الزوجية التي تؤدي إلى الحد الأدنى من استهلاك الطاقة. والأهم من ذلك، أن إشارة المكافأة لـ RL لا يتم الحصول عليها من البيئة ولكن يتم الحصول عليها داخليًا، مثل التكلفة العصبية الفعلية لمعالجة المحفزات البصرية الواردة. تشير النتائج إلى أن التعلم المعزز باستخدام إشارة المكافأة المولدة داخليًا يؤدي إلى سلوكيات غير تافهة للروبوت والتي يمكن تفسيرها من قبل مراقبين خارجيين على أنها "تفضيل" الروبوت لنمط بصري معين، والذي ظهر في الواقع فقط بناءً على مبدأ تقليل التكلفة العصبية.
DOI 10.1109/HUMANOIDS.2016.7803408
جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات
جامعة اوزيجين يتم إعادة توجيهك...

يرجى الانتظار