ProvocationProbe:从 Twitter 上生成挑衅性仇恨言论数据集
计算与语言
2024-10-28 v1
摘要
近年来,线上社交媒体平台充斥着仇恨言论,如种族主义、性别歧视、异化恐惧等。因此,众多社交媒体平台已采取措施来缓解仇恨言论在互联网上的传播。仇恨言论领域的特定概念是挑衅性仇恨,即挑起针对特定社区、种族、颜色、性别、宗教或民族的仇恨。在本工作中,我们引入了\textit{ProvocationProbe}——一个旨在探讨挑衅性仇恨言论与一般仇恨言论区别的数据集。为此研究,我们从 Twitter 收集了约两万条推文,涵盖九大全球争议。这些争议涉及种族主义、政治和宗教等 various themes。本文中,我们 (i) 在对所有争议进行全面审查后呈现了一个注释后的数据集, (ii) 通过识别诸如针对特定身份的攻击和仇恨原因等区别性特征,阐述了仇恨言论与挑衅性仇恨言论之间的差异。
引用
@article{arxiv.2410.19687,
title = {ProvocationProbe: Instigating Hate Speech Dataset from Twitter},
author = {Abhay Kumar and Vigneshwaran Shankaran and Rajesh Sharma},
journal= {arXiv preprint arXiv:2410.19687},
year = {2024}
}