تدريب تكيفي هجين لأقرب جار/مجموعة من أجل التكيف السريع للمتحدث في أنظمة تركيب الكلام الإحصائي
| العنوان | تدريب تكيفي هجين لأقرب جار/مجموعة من أجل التكيف السريع للمتحدث في أنظمة تركيب الكلام الإحصائي |
|---|---|
| المؤلف | محمدي، أمير، دمير أوغلو، جينك |
| تاريخ النشر: | 2013 |
| مكان النشر | - الرابطة الدولية لاتصالات الكلام |
| الموضوع | تركيب الكلام الإحصائي، تكيف المتحدث، التدريب على التكيف العنقودي، التكيف مع الصوت الذاتي |
| النوع | وثيقة |
| اللغة | الإنجليزية |
| رقمي | نعم |
| مخطوط | لا |
| المكتبة: | جامعة اوزيجين |
| معرف أصل المكتبة | 9781629934433 |
| رقم السجل | e72da822-5be8-4963-b726-475b4a5ce556 |
| موقع المكتبة | الهندسة الكهربائية والإلكترونية |
| التاريخ | 2013 |
| ملاحظات | نظرًا لقيود حقوق الطبع والنشر، فإن الوصول إلى النص الكامل لهذه المقالة متاح فقط عبر الاشتراك. |
| نص عينة | أصبح نهج تركيب الكلام الإحصائي (SSS) أحد الأساليب الأكثر شعبية في مجال تركيب الكلام. تتمثل ميزة نهج SSS في القدرة على التكيف مع المتحدث المستهدف من خلال بضع دقائق من بيانات التكيف. ومع ذلك، فإن العديد من التطبيقات، وخاصة في مجال الإلكترونيات الاستهلاكية، تتطلب التكيف مع بضع ثوانٍ فقط من البيانات التي يمكن إجراؤها باستخدام تقنيات التكيف الذاتي. على الرغم من أن هذه التقنيات تعمل بشكل جيد في التعرف على الكلام، إلا أنها معروفة بتوليد أدوات إدراكية في تركيب الكلام الإحصائي. هنا، نقترح طريقتين للتخفيف من مشاكل الجودة وتحسين تشابه المتحدث الذي تم الحصول عليه باستخدام خوارزمية التكيف الأساسية للصوت الذاتي. تعتمد طريقتنا الأولى على استخدام نهج بايزي لتقييد خوارزمية التكيف مع الصوت الذاتي للتحرك في اتجاهات واقعية في مساحة السماعة لتقليل الشوائب. تعتمد طريقتنا الثانية على العثور على مكبر صوت مرجعي قريب من المتحدث المستهدف، واستخدام مكبر الصوت المرجعي كنموذج أولي في خطوة ثانية لتكييف الصوت الذاتي. كان أداء كلتا الطريقتين أفضل بكثير من طريقة الصوت الذاتي الأساسية في اختبارات الجودة والتشابه الذاتية. |