中文

去人性化计算语言学分析框架

计算与语言 2020-10-02 v2

摘要

去人性化是一种有害的心理过程,常导致针对特定社会群体的极端群体间偏见、仇恨言论与暴力。尽管有这些严重后果以及海量可用数据,去人性化尚未在大规模上得到计算研究。借鉴社会心理学研究,我们创建了一个计算语言学框架,通过识别去人性化显著成分的语言相关特征来分析去人性化语言。我们随后应用该框架分析1986年至2015年《纽约时报》中关于LGBTQ群体的讨论。总体而言,我们发现随着时间推移对LGBTQ群体的描述愈发具有人性化。然而,我们发现标签homosexual比其他标签(如gay)更强烈地与去人性化态度相关联。我们提出的技术凸显了围绕边缘化群体的话语中的语言变异与变化过程。此外,大规模分析去人性化语言的能力对于自动检测和理解媒体偏见以及网络滥用语言具有启示意义。

关键词

引用

@article{arxiv.2003.03014,
  title  = {A Framework for the Computational Linguistic Analysis of Dehumanization},
  author = {Julia Mendelsohn and Yulia Tsvetkov and Dan Jurafsky},
  journal= {arXiv preprint arXiv:2003.03014},
  year   = {2020}
}

备注

31 pages, 6 figures (Appendix is 4 pages, 4 figures). Submitted to Frontiers in Artificial Intelligence (Language and Computation)