Yazar
Mübarek, H., Rashid, Amr, Derviş, K., Samia, Y., Abdel-Ali, A.
Basım Tarihi
2021
Basım Yeri
-
Hesaplamalı Dilbilim Derneği (ACL)
Tür
Belge
Dil
İngilizce
Dijital
Evet
Yazma
Hayır
Kütüphane
Özyeğin Üniversitesi
Demirbaş Numarası
978-195408509-1
Kayıt Numarası
4ba44e73-6907-4603-929c-e8667dbff1c9
Tarih
2021
Örnek Metin
Twitter'da saldırgan dili tespit etmenin, zorbalığı tespit etmekten/tahmin etmekten kutuplaşmayı ölçmeye kadar birçok uygulaması vardır. Bu yazıda geniş bir Arapça saldırgan tweet veri seti oluşturmaya odaklanıyoruz. Konuya, lehçeye veya hedefe göre önyargılı olmayan bir veri kümesi oluşturmaya yönelik bir yöntem sunuyoruz. Kabalık ve nefret söylemine yönelik özel etiketlerle bugüne kadarki en büyük Arapça veri setini üretiyoruz. Hangi konuların, lehçelerin ve cinsiyetin saldırgan tweetlerle en çok ilişkilendirildiğini ve Arapça konuşanların saldırgan dili nasıl kullandığını belirlemek için veri kümesini kapsamlı bir şekilde analiz ediyoruz. Son olarak SOTA tekniklerini kullanarak veri seti üzerinde güçlü sonuçlar (F1 = 83.2) üretmek için birçok deney yapıyoruz.