仇恨与政治:意大利语推文中针对政策制定者的仇恨检测
计算与语言
2021-07-13 v1
摘要
准确检测针对政治家、政策制定和政治理念的仇恨言论对维护民主与言论自由至关重要。遗憾的是,训练仇恨言论检测模型所需的标注数据有限且依赖于领域。在本文中,我们解决意大利语 Twitter 上针对政策制定者的仇恨言论分类问题,制作了该种语言下此类首个资源。我们收集并标注了 1264 条推文,考察了标注者间分歧的案例,并使用不同特征与算法进行了领域内与跨领域的仇恨言论分类。我们取得了 ROC AUC 0.83 的性能,分析了最具预测性的属性,并发现了反政策制定者与反移民领域不同的语言特征。最后,我们将标签话题网络可视化以捕捉仇恨与正常推文中使用的主题。
引用
@article{arxiv.2107.05357,
title = {Hate versus Politics: Detection of Hate against Policy makers in Italian tweets},
author = {Armend Duzha and Cristiano Casadei and Michael Tosi and Fabio Celli},
journal= {arXiv preprint arXiv:2107.05357},
year = {2021}
}
备注
to appear in SN social sciences - special issue on hate speech