中文

用于 Twitter 仇恨言论检测的预测式嵌入

计算与语言 2018-09-28 v1

摘要

我们提出一种基于神经网络的方法,用于对在线仇恨言论(尤其是种族主义与性别歧视言论)进行分类。利用预训练词嵌入以及由这些嵌入的简单全连接变换得到的最大/平均池化,我们能够在三个常用的公开可用数据集上预测仇恨言论的出现。与先前方法相比,我们的模型以显著更少的参数和极小的特征预处理,在所有三个数据集上达到或超越了最先进的 F1 性能。

关键词

引用

@article{arxiv.1809.10644,
  title  = {Predictive Embeddings for Hate Speech Detection on Twitter},
  author = {Rohan Kshirsagar and Tyus Cukuvac and Kathleen McKeown and Susan McGregor},
  journal= {arXiv preprint arXiv:1809.10644},
  year   = {2018}
}

备注

Accepted at Abusive Language Online Workshop, EMNLP 2018; 7 pages 7 figures