التحدث الهاتفي متعدد اللغات 2011. آسيا الوسطى / اتحاد البيانات اللغوية.

العنوان التحدث الهاتفي متعدد اللغات 2011. آسيا الوسطى / اتحاد البيانات اللغوية.
تاريخ النشر: 2018
الموضوع لغة ديوري > لغة ديوري المنطوقة > معالجة البيانات. اللغة الفارسية > اللغة الفارسية المنطوقة > معالجة البيانات. لغة البشتو > لغة الباشتو المنطوقة > معالجة البيانات. لغة ديوري > تحليل الخطاب. اللغة الفارسية > تحليل الخطاب. لغة الباشتو > تحليل الخطاب. المحادثة> معالجة البيانات. التعرف التلقائي على الكلام. اللغويات الحاسوبية. استخراج البيانات الصوتية الجسد (اللغويات)
النوع أخرى
اللغة fas,pus
رقمي نعم
مخطوط لا
الأبعاد الفيزيائية 1 online resource
المكتبة: جامعة ييل
معرف أصل المكتبة 1585638331
رقم السجل 99155737183408651
التاريخ 2018
ملاحظات المؤلفون: كارين جونز، ديفيد غراف، كيفن ووكر، ستيفاني ستراسل. مصدر البيانات: المحادثات الهاتفية. التطبيقات: تحديد اللغة. رقم أقل البلدان نموا: LDC2018S03. باللغة الدارية والفارسية والبشتوية. العنوان من الصفحة الرئيسية للمورد (موقع أقل البلدان نموًا، تمت الزيارة في 23 سبتمبر 2020).
نص عينة "الكلام الهاتفي متعدد اللغات 2011 - آسيا الوسطى تم تطويره من قبل اتحاد البيانات اللغوية (LDC) ويتكون من حوالي 37 ساعة من التحدث الهاتفي في ثلاثة أنواع مختلفة من اللغات في آسيا الوسطى: الداري والفارسية والباشتو. تم جمع البيانات في المقام الأول لدعم البحث وتقييم التكنولوجيا في تحديد اللغة التلقائي، وتم استخدام أجزاء من هذه المكالمات الهاتفية في تقييم التعرف على اللغة في NIST 2011 (LRE 2011) ركز على التمييز بين الأزواج اللغوية لـ 24 لغة/لهجة، والتي يمكن اعتبار بعضها مفهومًا بشكل متبادل أو مرتبط بشكل وثيق. تم تعيين المشاركين من قبل المتحدثين الأصليين الذين اتصلوا بمعارفهم في شبكتهم الاجتماعية، وقاموا بإجراء مكالمة واحدة، تصل إلى 15 دقيقة، لكل من المعارف لم يتم جمع المعلومات الديموغرافية عن المشاركين ونوع اللهجة والضوضاء بتنسيق ملف MS-WAV (RIFF) المضغوط بـ FLAC (*.flac)؛ عند عدم ضغطه، يكون كل ملف عبارة عن قناتين، يتم تسجيلهما بمعدل 8000 عينة في الثانية مع عينات مخزنة كأعداد صحيحة موقعة 16 بت، مما يمثل تحويلاً بدون فقدان من بيانات عينة mu-law الأصلية كما تم التقاطها رقميًا من شبكة الهاتف العامة عدد المكالمات، وإجمالي عدد ساعات الصوت المسجل، والحجم الإجمالي للبيانات المضغوطة" - كتالوج LDC عبر الإنترنت.
Kataloğa Eklendi September 23, 2020
Diğer Sorumlular Jones, Karen, creator Linguistic Data Consortium, issuing body
Yerel Notlar Access is available to the Yale community.
عرض في المصدر جامعة ييل جامعة ييل - محرك بحث المخطوطات العثمانية
جامعة ييل - محرك بحث المخطوطات العثمانية جامعة ييل

التحدث الهاتفي متعدد اللغات 2011. آسيا الوسطى / اتحاد البيانات اللغوية.

تاريخ النشر 2018
الموضوع لغة ديوري > لغة ديوري المنطوقة > معالجة البيانات. اللغة الفارسية > اللغة الفارسية المنطوقة > معالجة البيانات. لغة البشتو > لغة الباشتو المنطوقة > معالجة البيانات. لغة ديوري > تحليل الخطاب. اللغة الفارسية > تحليل الخطاب. لغة الباشتو > تحليل الخطاب. المحادثة> معالجة البيانات. التعرف التلقائي على الكلام. اللغويات الحاسوبية. استخراج البيانات الصوتية الجسد (اللغويات)
النوع أخرى
اللغة fas,pus
رقمي نعم
مخطوط لا
الأبعاد الفيزيائية 1 online resource
المكتبة جامعة ييل
معرف أصل المكتبة 1585638331
رقم السجل 99155737183408651
التاريخ 2018
ملاحظات المؤلفون: كارين جونز، ديفيد غراف، كيفن ووكر، ستيفاني ستراسل. مصدر البيانات: المحادثات الهاتفية. التطبيقات: تحديد اللغة. رقم أقل البلدان نموا: LDC2018S03. باللغة الدارية والفارسية والبشتوية. العنوان من الصفحة الرئيسية للمورد (موقع أقل البلدان نموًا، تمت الزيارة في 23 سبتمبر 2020).
نص عينة "الكلام الهاتفي متعدد اللغات 2011 - آسيا الوسطى تم تطويره من قبل اتحاد البيانات اللغوية (LDC) ويتكون من حوالي 37 ساعة من التحدث الهاتفي في ثلاثة أنواع مختلفة من اللغات في آسيا الوسطى: الداري والفارسية والباشتو. تم جمع البيانات في المقام الأول لدعم البحث وتقييم التكنولوجيا في تحديد اللغة التلقائي، وتم استخدام أجزاء من هذه المكالمات الهاتفية في تقييم التعرف على اللغة في NIST 2011 (LRE 2011) ركز على التمييز بين الأزواج اللغوية لـ 24 لغة/لهجة، والتي يمكن اعتبار بعضها مفهومًا بشكل متبادل أو مرتبط بشكل وثيق. تم تعيين المشاركين من قبل المتحدثين الأصليين الذين اتصلوا بمعارفهم في شبكتهم الاجتماعية، وقاموا بإجراء مكالمة واحدة، تصل إلى 15 دقيقة، لكل من المعارف لم يتم جمع المعلومات الديموغرافية عن المشاركين ونوع اللهجة والضوضاء بتنسيق ملف MS-WAV (RIFF) المضغوط بـ FLAC (*.flac)؛ عند عدم ضغطه، يكون كل ملف عبارة عن قناتين، يتم تسجيلهما بمعدل 8000 عينة في الثانية مع عينات مخزنة كأعداد صحيحة موقعة 16 بت، مما يمثل تحويلاً بدون فقدان من بيانات عينة mu-law الأصلية كما تم التقاطها رقميًا من شبكة الهاتف العامة عدد المكالمات، وإجمالي عدد ساعات الصوت المسجل، والحجم الإجمالي للبيانات المضغوطة" - كتالوج LDC عبر الإنترنت.
Kataloğa Eklendi September 23, 2020
Diğer Sorumlular Jones, Karen, creator Linguistic Data Consortium, issuing body
Yerel Notlar Access is available to the Yale community.
جامعة ييل - محرك بحث المخطوطات العثمانية
جامعة ييل يتم إعادة توجيهك...

يرجى الانتظار