Persica: مجموعه ای فارسی برای متن کاوی چند منظوره و پردازش زبان طبیعی

عنوان Persica: مجموعه ای فارسی برای متن کاوی چند منظوره و پردازش زبان طبیعی
نویسنده اقبالی زاده، ح.، حسینی، ب.، کذاف، ص.، خدابخش، علی.
تاریخ انتشار: 2012
محل انتشار - IEEE
موضوع طبقه بندی متن، متن کاوی، طبقه بندی، تشخیص موضوع و روند
نوع سند
زبان انگلیسی
دیجیتال بله
نسخه خطی خیر
کتابخانه: دانشگاه اوزیغین
شناسه دارایی کتابخانه 2-s2.0-84876395015
شماره ثبت dc04dc2e-213c-4b81-93a6-b706f0428e0e
تاریخ 2012
متن نمونه فقدان مجموعه متن چندکاربردی علیرغم افزایش داده های متنی، یک گلوگاه جدی در متن کاوی و پردازش زبان طبیعی به ویژه در زبان فارسی است. در این مقاله مجموعه جدیدی برای تحلیل مقالات NEWS به زبان فارسی به نام پرسیکا ارائه شده است. تجزیه و تحلیل NEWS شامل طبقه بندی اخبار، کشف و طبقه بندی موضوع، کشف روند، طبقه بندی طبقه بندی و بسیاری از روش های دیگر است. برخورد با NEWS الزامات خاصی دارد. اول از همه، برای انجام آزمایشات به یک مجموعه معتبر و غنی از محتوای اخبار نیاز دارد. رویکرد ما مبتنی بر طبقه‌بندی اصلاح‌شده و نرمال‌سازی داده‌ها بر روی مقالات فارسی نیوز است که منجر به ایجاد یک مجموعه فارسی چندمنظوره شده است که نتایج معقولی را در نتایج متن‌کاوی نشان می‌دهد. در ادبیات، با توجه به دانش ما، مجموعه های فارسی کمی وجود دارد، اما هیچ یک از آنها ویژگی روند زمانی اخبار فارسی را ندارند. نتایج تجربی در معیار ما نشان می دهد که پرسیکا علاوه بر کاهش ابعاد مسئله و محتوای بی فایده، روایی و پایایی قابل قبولی را در مقایسه با پیکره های استاندارد موجود در ادبیات حفظ می کند.
DOI 10.1109/ISTEL.2012.6483172
مشاهده در منبع دانشگاه اوزیغین دانشگاه اوزیغین - موتور جستجوی آثار تاریخی، آرشیوها و نشریات
دانشگاه اوزیغین - موتور جستجوی آثار تاریخی، آرشیوها و نشریات دانشگاه اوزیغین

Persica: مجموعه ای فارسی برای متن کاوی چند منظوره و پردازش زبان طبیعی

نویسنده اقبالی زاده، ح.، حسینی، ب.، کذاف، ص.، خدابخش، علی.
تاریخ انتشار 2012
محل انتشار - IEEE
موضوع طبقه بندی متن، متن کاوی، طبقه بندی، تشخیص موضوع و روند
نوع سند
زبان انگلیسی
دیجیتال بله
نسخه خطی خیر
کتابخانه دانشگاه اوزیغین
شناسه دارایی کتابخانه 2-s2.0-84876395015
شماره ثبت dc04dc2e-213c-4b81-93a6-b706f0428e0e
تاریخ 2012
متن نمونه فقدان مجموعه متن چندکاربردی علیرغم افزایش داده های متنی، یک گلوگاه جدی در متن کاوی و پردازش زبان طبیعی به ویژه در زبان فارسی است. در این مقاله مجموعه جدیدی برای تحلیل مقالات NEWS به زبان فارسی به نام پرسیکا ارائه شده است. تجزیه و تحلیل NEWS شامل طبقه بندی اخبار، کشف و طبقه بندی موضوع، کشف روند، طبقه بندی طبقه بندی و بسیاری از روش های دیگر است. برخورد با NEWS الزامات خاصی دارد. اول از همه، برای انجام آزمایشات به یک مجموعه معتبر و غنی از محتوای اخبار نیاز دارد. رویکرد ما مبتنی بر طبقه‌بندی اصلاح‌شده و نرمال‌سازی داده‌ها بر روی مقالات فارسی نیوز است که منجر به ایجاد یک مجموعه فارسی چندمنظوره شده است که نتایج معقولی را در نتایج متن‌کاوی نشان می‌دهد. در ادبیات، با توجه به دانش ما، مجموعه های فارسی کمی وجود دارد، اما هیچ یک از آنها ویژگی روند زمانی اخبار فارسی را ندارند. نتایج تجربی در معیار ما نشان می دهد که پرسیکا علاوه بر کاهش ابعاد مسئله و محتوای بی فایده، روایی و پایایی قابل قبولی را در مقایسه با پیکره های استاندارد موجود در ادبیات حفظ می کند.
DOI 10.1109/ISTEL.2012.6483172
دانشگاه اوزیغین - موتور جستجوی آثار تاریخی، آرشیوها و نشریات
دانشگاه اوزیغین شما در حال هدایت مجدد هستید...

لطفاً صبر کنید