仇恨言论与反击言论检测:对话上下文至关重要
计算与语言
2022-06-15 v1
摘要
仇恨言论正随用户生成内容泛滥于网络空间。本文研究了对话上下文在在线仇恨与反击言论标注和检测中的作用,其中上下文定义为对话线程中的前一条评论。我们创建了一个上下文感知数据集,用于 Reddit 评论的三分类任务:仇恨言论、反击言论或中立。我们的分析表明,上下文对识别仇恨与反击言论至关重要:大多数评论的人类判断会因是否向标注者展示上下文而改变。语言学分析揭示了人们表达仇恨与反击言论所用语言的规律。实验结果显示,若考虑上下文,神经网络可获得显著更好的结果。我们还给出了定性错误分析,阐明了(a)上下文何时及为何有益,以及(b)考虑上下文时我们最佳模型仍存在的错误。
引用
@article{arxiv.2206.06423,
title = {Hate Speech and Counter Speech Detection: Conversational Context Does Matter},
author = {Xinchen Yu and Eduardo Blanco and Lingzi Hong},
journal= {arXiv preprint arXiv:2206.06423},
year = {2022}
}
备注
Accepted by NAACL 2022