تدريب تكيفي هجين لأقرب جار/مجموعة من أجل التكيف السريع للمتحدث في أنظمة تركيب الكلام الإحصائي

العنوان تدريب تكيفي هجين لأقرب جار/مجموعة من أجل التكيف السريع للمتحدث في أنظمة تركيب الكلام الإحصائي
المؤلف محمدي، أمير، دمير أوغلو، جينك
تاريخ النشر: 2013
مكان النشر - الرابطة الدولية لاتصالات الكلام
الموضوع تركيب الكلام الإحصائي، تكيف المتحدث، التدريب على التكيف العنقودي، التكيف مع الصوت الذاتي
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة: جامعة اوزيجين
معرف أصل المكتبة 9781629934433
رقم السجل e72da822-5be8-4963-b726-475b4a5ce556
موقع المكتبة الهندسة الكهربائية والإلكترونية
التاريخ 2013
ملاحظات نظرًا لقيود حقوق الطبع والنشر، فإن الوصول إلى النص الكامل لهذه المقالة متاح فقط عبر الاشتراك.
نص عينة أصبح نهج تركيب الكلام الإحصائي (SSS) أحد الأساليب الأكثر شعبية في مجال تركيب الكلام. تتمثل ميزة نهج SSS في القدرة على التكيف مع المتحدث المستهدف من خلال بضع دقائق من بيانات التكيف. ومع ذلك، فإن العديد من التطبيقات، وخاصة في مجال الإلكترونيات الاستهلاكية، تتطلب التكيف مع بضع ثوانٍ فقط من البيانات التي يمكن إجراؤها باستخدام تقنيات التكيف الذاتي. على الرغم من أن هذه التقنيات تعمل بشكل جيد في التعرف على الكلام، إلا أنها معروفة بتوليد أدوات إدراكية في تركيب الكلام الإحصائي. هنا، نقترح طريقتين للتخفيف من مشاكل الجودة وتحسين تشابه المتحدث الذي تم الحصول عليه باستخدام خوارزمية التكيف الأساسية للصوت الذاتي. تعتمد طريقتنا الأولى على استخدام نهج بايزي لتقييد خوارزمية التكيف مع الصوت الذاتي للتحرك في اتجاهات واقعية في مساحة السماعة لتقليل الشوائب. تعتمد طريقتنا الثانية على العثور على مكبر صوت مرجعي قريب من المتحدث المستهدف، واستخدام مكبر الصوت المرجعي كنموذج أولي في خطوة ثانية لتكييف الصوت الذاتي. كان أداء كلتا الطريقتين أفضل بكثير من طريقة الصوت الذاتي الأساسية في اختبارات الجودة والتشابه الذاتية.
عرض في المصدر جامعة اوزيجين جامعة اوزيجين - محرك بحث المخطوطات العثمانية
جامعة اوزيجين - محرك بحث المخطوطات العثمانية جامعة اوزيجين

تدريب تكيفي هجين لأقرب جار/مجموعة من أجل التكيف السريع للمتحدث في أنظمة تركيب الكلام الإحصائي

المؤلف محمدي، أمير، دمير أوغلو، جينك
تاريخ النشر 2013
مكان النشر - الرابطة الدولية لاتصالات الكلام
الموضوع تركيب الكلام الإحصائي، تكيف المتحدث، التدريب على التكيف العنقودي، التكيف مع الصوت الذاتي
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة جامعة اوزيجين
معرف أصل المكتبة 9781629934433
رقم السجل e72da822-5be8-4963-b726-475b4a5ce556
موقع المكتبة الهندسة الكهربائية والإلكترونية
التاريخ 2013
ملاحظات نظرًا لقيود حقوق الطبع والنشر، فإن الوصول إلى النص الكامل لهذه المقالة متاح فقط عبر الاشتراك.
نص عينة أصبح نهج تركيب الكلام الإحصائي (SSS) أحد الأساليب الأكثر شعبية في مجال تركيب الكلام. تتمثل ميزة نهج SSS في القدرة على التكيف مع المتحدث المستهدف من خلال بضع دقائق من بيانات التكيف. ومع ذلك، فإن العديد من التطبيقات، وخاصة في مجال الإلكترونيات الاستهلاكية، تتطلب التكيف مع بضع ثوانٍ فقط من البيانات التي يمكن إجراؤها باستخدام تقنيات التكيف الذاتي. على الرغم من أن هذه التقنيات تعمل بشكل جيد في التعرف على الكلام، إلا أنها معروفة بتوليد أدوات إدراكية في تركيب الكلام الإحصائي. هنا، نقترح طريقتين للتخفيف من مشاكل الجودة وتحسين تشابه المتحدث الذي تم الحصول عليه باستخدام خوارزمية التكيف الأساسية للصوت الذاتي. تعتمد طريقتنا الأولى على استخدام نهج بايزي لتقييد خوارزمية التكيف مع الصوت الذاتي للتحرك في اتجاهات واقعية في مساحة السماعة لتقليل الشوائب. تعتمد طريقتنا الثانية على العثور على مكبر صوت مرجعي قريب من المتحدث المستهدف، واستخدام مكبر الصوت المرجعي كنموذج أولي في خطوة ثانية لتكييف الصوت الذاتي. كان أداء كلتا الطريقتين أفضل بكثير من طريقة الصوت الذاتي الأساسية في اختبارات الجودة والتشابه الذاتية.
جامعة اوزيجين - محرك بحث المخطوطات العثمانية
جامعة اوزيجين يتم إعادة توجيهك...

يرجى الانتظار