تجزیه و تحلیل شباهت گوینده در سیستم های آماری سنتز گفتار با استفاده از رویکرد ترکیبی

عنوان تجزیه و تحلیل شباهت گوینده در سیستم های آماری سنتز گفتار با استفاده از رویکرد ترکیبی
نویسنده گونر، اکرم، محمدی، ع.، دمیروغلو، سنک
تاریخ انتشار: 2012
محل انتشار - IEEE
موضوع تشخیص گوینده، سنتز گفتار، تجزیه و تحلیل آماری
نوع سند
زبان انگلیسی
دیجیتال بله
نسخه خطی خیر
کتابخانه: دانشگاه اوزیغین
شناسه دارایی کتابخانه 978-1-4673-1068-0
شماره ثبت 6707d5da-edb6-44ec-8719-dd8fce587dfc
محل کتابخانه مهندسی برق و الکترونیک
تاریخ 2012
یادداشت‌ها با توجه به محدودیت های کپی رایت، دسترسی به متن کامل این مقاله تنها از طریق اشتراک امکان پذیر است.
متن نمونه روش سنتز گفتار آماری (SSS) به یکی از محبوب ترین و موفق ترین روش ها در زمینه سنتز گفتار تبدیل شده است. انتقال گفتار صاف، بدون خطاهای ساختگی که در سیستم های انتخاب واحد مشاهده می شود، می تواند با رویکرد SSS ایجاد شود. با این حال، یک مشکل شناخته شده در مورد SSS عدم شباهت صدا به بلندگوی هدف است. این مسئله هم در مدل‌های وابسته به بلندگو و هم در مدل‌هایی که از صدای متوسط ​​اقتباس شده‌اند، بروز می‌کند. علاوه بر این، در سازگاری بلندگو، شباهت به بلندگوی مورد نظر پس از حدود یک دقیقه داده های سازگاری به طور قابل توجهی افزایش نمی یابد که به طور بالقوه نشان دهنده تنگنا(های) ذاتی در سیستم است. در اینجا، ما استفاده از رویکرد ترکیبی گفتار ترکیبی را برای درک عوامل کلیدی پشت مشکل شباهت سخنران پیشنهاد می‌کنیم. برای این منظور، ما سعی می کنیم به این سوال پاسخ دهیم: کدام بخش ها و پارامترهای گفتار، در صورت تولید/ترکیب بهتر، بهبود قابل توجهی در شباهت گوینده خواهند داشت؟ در این کار، روش‌های ترکیبی ما شرح داده شده و نتایج آزمون شنیداری ارائه و مورد بحث قرار می‌گیرد.
مشاهده در منبع دانشگاه اوزیغین دانشگاه اوزیغین - موتور جستجوی آثار تاریخی، آرشیوها و نشریات
دانشگاه اوزیغین - موتور جستجوی آثار تاریخی، آرشیوها و نشریات دانشگاه اوزیغین

تجزیه و تحلیل شباهت گوینده در سیستم های آماری سنتز گفتار با استفاده از رویکرد ترکیبی

نویسنده گونر، اکرم، محمدی، ع.، دمیروغلو، سنک
تاریخ انتشار 2012
محل انتشار - IEEE
موضوع تشخیص گوینده، سنتز گفتار، تجزیه و تحلیل آماری
نوع سند
زبان انگلیسی
دیجیتال بله
نسخه خطی خیر
کتابخانه دانشگاه اوزیغین
شناسه دارایی کتابخانه 978-1-4673-1068-0
شماره ثبت 6707d5da-edb6-44ec-8719-dd8fce587dfc
محل کتابخانه مهندسی برق و الکترونیک
تاریخ 2012
یادداشت‌ها با توجه به محدودیت های کپی رایت، دسترسی به متن کامل این مقاله تنها از طریق اشتراک امکان پذیر است.
متن نمونه روش سنتز گفتار آماری (SSS) به یکی از محبوب ترین و موفق ترین روش ها در زمینه سنتز گفتار تبدیل شده است. انتقال گفتار صاف، بدون خطاهای ساختگی که در سیستم های انتخاب واحد مشاهده می شود، می تواند با رویکرد SSS ایجاد شود. با این حال، یک مشکل شناخته شده در مورد SSS عدم شباهت صدا به بلندگوی هدف است. این مسئله هم در مدل‌های وابسته به بلندگو و هم در مدل‌هایی که از صدای متوسط ​​اقتباس شده‌اند، بروز می‌کند. علاوه بر این، در سازگاری بلندگو، شباهت به بلندگوی مورد نظر پس از حدود یک دقیقه داده های سازگاری به طور قابل توجهی افزایش نمی یابد که به طور بالقوه نشان دهنده تنگنا(های) ذاتی در سیستم است. در اینجا، ما استفاده از رویکرد ترکیبی گفتار ترکیبی را برای درک عوامل کلیدی پشت مشکل شباهت سخنران پیشنهاد می‌کنیم. برای این منظور، ما سعی می کنیم به این سوال پاسخ دهیم: کدام بخش ها و پارامترهای گفتار، در صورت تولید/ترکیب بهتر، بهبود قابل توجهی در شباهت گوینده خواهند داشت؟ در این کار، روش‌های ترکیبی ما شرح داده شده و نتایج آزمون شنیداری ارائه و مورد بحث قرار می‌گیرد.
دانشگاه اوزیغین - موتور جستجوی آثار تاریخی، آرشیوها و نشریات
دانشگاه اوزیغین شما در حال هدایت مجدد هستید...

لطفاً صبر کنید