تاریخ انتشار
2024
موضوع
زبانشناسی محاسباتی. گفتار > پردازش داده. تشخیص خودکار گفتار
نوع
دیگر
زبان
ara,eng,fas,pus,urd
دیجیتال
بله
نسخه خطی
خیر
ابعاد فیزیکی
1 online resource
کتابخانه
دانشگاه ییل
شماره ثبت
99171457673408651
تاریخ
2024
یادداشتها
نویسندگان: مراد بلحاج، الهام بندلالی، الالیا لخدری. منبع داده: مکالمات تلفنی نوع داده: صدا، متن کاربردها: تشخیص فعالیت گفتار. شماره LDC: LDC2024S03. داده ها: تمام فایل های صوتی به صورت تک کانال، PCM 16 بیتی، 16000 نمونه در ثانیه ارائه می شوند. فشرده سازی FLAC بدون اتلاف در همه فایل ها استفاده می شود. هنگامی که فایل ها فشرده نمی شوند، هدرهای فایل "MS-WAV" (RIFF) دارند. صوت به زبان انگلیسی، فارسی، پشتو، اردو و عنوان عربی شامی از صفحه اصلی منبع (وب سایت LDC، مشاهده شده در 30 آوریل 2024).
متن نمونه
تراکم گفتار کم موشها (LDC2024S03) توسط کنسرسیوم دادههای زبانی (LDC) توسعه داده شده است و شامل تقریباً 87 ساعت نمونههای گفتاری و غیرگفتاری عربی، فارسی، پشتو و اردو شامی است. ضبطها با الحاق یک سیستم اندازهگیری تصادفی صداها، صداها و عملکردهای ارتباطی ایجاد شده است. در سیستمهای تشخیص فعالیت گفتار RATS."--کاتالوگ آنلاین LDC.
Kataloğa Eklendi
April 30, 2024
Diğer Sorumlular
Belhadj, Mourad, creator Linguistic Data Consortium, issuing body
İçindekiler
data file (contains the audio files) docs file (contains additional documentation, metadata, and a file table).
Yerel Notlar
Access is available to the Yale community.
Varyant ve İlgili Başlıklar
Robust Automatic Transcription of Speech low speech density Low speech density