用于检测仇恨者的统一多语言作者画像
计算与语言
2021-09-21 v1 人工智能
机器学习
摘要
本文提出一种统一的用户画像框架,通过处理用户推文(无论何种语言)来识别仇恨言论传播者。该框架使用句子 transformer 对推文进行编码,并应用注意力机制选择重要推文以学习用户画像。此外,注意力层通过在词元与帖子层级产生注意力权重,有助于解释为何某用户是仇恨言论传播者。我们提出的模型优于最先进的多语言 transformer 模型。
引用
@article{arxiv.2109.09233,
title = {Unified and Multilingual Author Profiling for Detecting Haters},
author = {Ipek Baris Schlicht and Angel Felipe Magnossão de Paula},
journal= {arXiv preprint arXiv:2109.09233},
year = {2021}
}
备注
9 pages, 2 figures, see the original paper: http://ceur-ws.org/Vol-2936/paper-157.pdf