基于程度的恶意言论分类:利用Twitter数据
计算与语言
2018-06-13 v1
摘要
恶意言论有多种形式,并以不同方式困扰着社交媒体。如果我们需要打击其中不同程度的仇恨言论和辱骂行为,分类就需要基于复杂的衍生情形来界定并追究责任,而非仅针对种族主义、性别歧视或反对某些特定群体与社区。本文主要描述了我们如何基于仇恨意图的程度创建恶意言论的本体分类,并据此对Twitter数据进行标注。本文的关键贡献在于我们基于文本中发现的本体类别和恶意言论程度所创建的新推文数据集。我们还提出了用于识别文本中这些相应恶意言论类别的监督分类系统。
引用
@article{arxiv.1806.04197,
title = {Degree based Classification of Harmful Speech using Twitter Data},
author = {Sanjana Sharma and Saksham Agrawal and Manish Shrivastava},
journal= {arXiv preprint arXiv:1806.04197},
year = {2018}
}