تحليل تشابه المتحدثين في أنظمة تركيب الكلام الإحصائي باستخدام نهج هجين
| العنوان | تحليل تشابه المتحدثين في أنظمة تركيب الكلام الإحصائي باستخدام نهج هجين |
|---|---|
| المؤلف | غونر، أكرم، محمدي، أ.، دمير أوغلو، جينك |
| تاريخ النشر: | 2012 |
| مكان النشر | - IEEE |
| الموضوع | التعرف على المتحدث، تركيب الكلام، التحليل الإحصائي |
| النوع | وثيقة |
| اللغة | الإنجليزية |
| رقمي | نعم |
| مخطوط | لا |
| المكتبة: | جامعة اوزيجين |
| معرف أصل المكتبة | 978-1-4673-1068-0 |
| رقم السجل | 6707d5da-edb6-44ec-8719-dd8fce587dfc |
| موقع المكتبة | الهندسة الكهربائية والإلكترونية |
| التاريخ | 2012 |
| ملاحظات | نظرًا لقيود حقوق الطبع والنشر، فإن الوصول إلى النص الكامل لهذه المقالة متاح فقط عبر الاشتراك. |
| نص عينة | أصبح نهج تركيب الكلام الإحصائي (SSS) أحد الأساليب الأكثر شعبية ونجاحًا في مجال تركيب الكلام. يمكن إنشاء انتقالات سلسة للكلام، دون الأخطاء الزائفة التي لوحظت في أنظمة اختيار الوحدات، باستخدام نهج SSS. ومع ذلك، هناك مشكلة معروفة في نظام SSS وهي عدم تشابه الصوت مع المتحدث المستهدف. تنشأ المشكلة في النماذج المعتمدة على المتحدث والنماذج المقتبسة من الأصوات المتوسطة. علاوة على ذلك، في تكيف المتحدث، لا يتزايد التشابه مع المتحدث المستهدف بشكل ملحوظ بعد حوالي دقيقة واحدة من بيانات التكيف التي من المحتمل أن تشير إلى الاختناق (الاختناقات) المتأصلة في النظام. هنا، نقترح استخدام نهج تركيب الكلام الهجين لفهم العوامل الرئيسية وراء مشكلة تشابه المتحدث. ولتحقيق هذه الغاية، نحاول الإجابة على السؤال التالي: ما هي أجزاء ومعلمات الكلام، إذا تم إنشاؤها/توليفها بشكل أفضل، سيكون لها تحسن كبير في تشابه المتحدث؟ في هذا العمل، يتم وصف طرقنا الهجينة وعرض ومناقشة نتائج اختبار الاستماع. |