تحليل تشابه المتحدثين في أنظمة تركيب الكلام الإحصائي باستخدام نهج هجين

العنوان تحليل تشابه المتحدثين في أنظمة تركيب الكلام الإحصائي باستخدام نهج هجين
المؤلف غونر، أكرم، محمدي، أ.، دمير أوغلو، جينك
تاريخ النشر: 2012
مكان النشر - IEEE
الموضوع التعرف على المتحدث، تركيب الكلام، التحليل الإحصائي
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة: جامعة اوزيجين
معرف أصل المكتبة 978-1-4673-1068-0
رقم السجل 6707d5da-edb6-44ec-8719-dd8fce587dfc
موقع المكتبة الهندسة الكهربائية والإلكترونية
التاريخ 2012
ملاحظات نظرًا لقيود حقوق الطبع والنشر، فإن الوصول إلى النص الكامل لهذه المقالة متاح فقط عبر الاشتراك.
نص عينة أصبح نهج تركيب الكلام الإحصائي (SSS) أحد الأساليب الأكثر شعبية ونجاحًا في مجال تركيب الكلام. يمكن إنشاء انتقالات سلسة للكلام، دون الأخطاء الزائفة التي لوحظت في أنظمة اختيار الوحدات، باستخدام نهج SSS. ومع ذلك، هناك مشكلة معروفة في نظام SSS وهي عدم تشابه الصوت مع المتحدث المستهدف. تنشأ المشكلة في النماذج المعتمدة على المتحدث والنماذج المقتبسة من الأصوات المتوسطة. علاوة على ذلك، في تكيف المتحدث، لا يتزايد التشابه مع المتحدث المستهدف بشكل ملحوظ بعد حوالي دقيقة واحدة من بيانات التكيف التي من المحتمل أن تشير إلى الاختناق (الاختناقات) المتأصلة في النظام. هنا، نقترح استخدام نهج تركيب الكلام الهجين لفهم العوامل الرئيسية وراء مشكلة تشابه المتحدث. ولتحقيق هذه الغاية، نحاول الإجابة على السؤال التالي: ما هي أجزاء ومعلمات الكلام، إذا تم إنشاؤها/توليفها بشكل أفضل، سيكون لها تحسن كبير في تشابه المتحدث؟ في هذا العمل، يتم وصف طرقنا الهجينة وعرض ومناقشة نتائج اختبار الاستماع.
عرض في المصدر جامعة اوزيجين جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات
جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات جامعة اوزيجين

تحليل تشابه المتحدثين في أنظمة تركيب الكلام الإحصائي باستخدام نهج هجين

المؤلف غونر، أكرم، محمدي، أ.، دمير أوغلو، جينك
تاريخ النشر 2012
مكان النشر - IEEE
الموضوع التعرف على المتحدث، تركيب الكلام، التحليل الإحصائي
النوع وثيقة
اللغة الإنجليزية
رقمي نعم
مخطوط لا
المكتبة جامعة اوزيجين
معرف أصل المكتبة 978-1-4673-1068-0
رقم السجل 6707d5da-edb6-44ec-8719-dd8fce587dfc
موقع المكتبة الهندسة الكهربائية والإلكترونية
التاريخ 2012
ملاحظات نظرًا لقيود حقوق الطبع والنشر، فإن الوصول إلى النص الكامل لهذه المقالة متاح فقط عبر الاشتراك.
نص عينة أصبح نهج تركيب الكلام الإحصائي (SSS) أحد الأساليب الأكثر شعبية ونجاحًا في مجال تركيب الكلام. يمكن إنشاء انتقالات سلسة للكلام، دون الأخطاء الزائفة التي لوحظت في أنظمة اختيار الوحدات، باستخدام نهج SSS. ومع ذلك، هناك مشكلة معروفة في نظام SSS وهي عدم تشابه الصوت مع المتحدث المستهدف. تنشأ المشكلة في النماذج المعتمدة على المتحدث والنماذج المقتبسة من الأصوات المتوسطة. علاوة على ذلك، في تكيف المتحدث، لا يتزايد التشابه مع المتحدث المستهدف بشكل ملحوظ بعد حوالي دقيقة واحدة من بيانات التكيف التي من المحتمل أن تشير إلى الاختناق (الاختناقات) المتأصلة في النظام. هنا، نقترح استخدام نهج تركيب الكلام الهجين لفهم العوامل الرئيسية وراء مشكلة تشابه المتحدث. ولتحقيق هذه الغاية، نحاول الإجابة على السؤال التالي: ما هي أجزاء ومعلمات الكلام، إذا تم إنشاؤها/توليفها بشكل أفضل، سيكون لها تحسن كبير في تشابه المتحدث؟ في هذا العمل، يتم وصف طرقنا الهجينة وعرض ومناقشة نتائج اختبار الاستماع.
جامعة اوزيجين - محرك بحث الآثار التاريخية والأرشيفات والدوريات
جامعة اوزيجين يتم إعادة توجيهك...

يرجى الانتظار