社交媒体中仇恨言论的检测
计算与语言
2017-12-29 v2
摘要
在本文中,我们考察了在社交媒体中检测仇恨言论的方法,同时将其与一般的粗话区分开来。我们旨在通过使用最近发布的为此目的而标注的数据集应用监督分类方法,为此任务建立词汇基线。作为特征,我们的系统使用了字符n元语法、词n元语法和词跳跃语法。我们在三个类别中识别帖子获得了78%的准确率。结果表明,主要挑战在于将粗话与仇恨言论相互区分。文中讨论了若干未来工作的方向。
引用
@article{arxiv.1712.06427,
title = {Detecting Hate Speech in Social Media},
author = {Shervin Malmasi and Marcos Zampieri},
journal= {arXiv preprint arXiv:1712.06427},
year = {2017}
}
备注
Proceedings of Recent Advances in Natural Language Processing (RANLP). pp. 467-472. Varna, Bulgaria