来自白人至上主义论坛的仇恨言论数据集
计算与语言
2018-09-13 v1
摘要
仇恨言论通常被定义为任何基于种族、肤色、民族、性别、性取向、国籍、宗教或其他特征贬低目标群体的交流。由于社交媒体上用户生成内容的海量增长,仇恨言论的数量也在稳步增加。过去几年中,对在线仇恨言论检测尤其是该任务自动化的兴趣持续增长,其社会影响也随之扩大。本文描述了一个仇恨言论数据集,由数千个被手动标注为含或不含仇恨言论的句子组成。这些句子提取自白人至上主义论坛Stormfront。我们开发了一款自定义标注工具来执行手动标注任务,该工具除其他功能外,允许标注者在标注前选择是否阅读句子上下文。本文还对所得数据集进行了细致的定性与定量研究,并使用不同分类模型进行了若干基线实验。该数据集已公开可用。
引用
@article{arxiv.1809.04444,
title = {Hate Speech Dataset from a White Supremacy Forum},
author = {Ona de Gibert and Naiara Perez and Aitor García-Pablos and Montse Cuadros},
journal= {arXiv preprint arXiv:1809.04444},
year = {2018}
}
备注
Accepted at 2nd Workshop on Abusive Language Online