中文

仇恨言论如何随目标身份而异:一项计算分析

计算与语言 2022-12-08 v2

摘要

本文研究了仇恨言论如何根据其针对的身份以系统性方式发生变化。在多个标注了目标身份的仇恨言论数据集上,我们发现针对特定身份群体训练的仇恨言论分类器难以泛化到其他目标身份。这为不同目标身份下仇恨言论的差异提供了经验证据;随后我们探究了构成这种差异的模式。我们发现,与目标身份群体的相对社会权力相比,所针对的人口统计类别(例如性别/性取向或种族/民族)似乎对仇恨言论的语言有更大的影响。我们还发现,与针对特定身份的仇恨言论相关的词汇往往涉及刻板印象、压迫历史、当前社会运动以及身份特有的其他社会背景。这些实验表明,在自动化仇恨言论分类中考虑目标身份以及与之相关的社会背景十分重要。

关键词

引用

@article{arxiv.2210.10839,
  title  = {How Hate Speech Varies by Target Identity: A Computational Analysis},
  author = {Michael Miller Yoder and Lynnette Hui Xian Ng and David West Brown and Kathleen M. Carley},
  journal= {arXiv preprint arXiv:2210.10839},
  year   = {2022}
}

备注

CoNLL 2022 camera-ready + fixed minor figure error