你推什么你就是什么:用历史推文对用户画像以改进仇恨言论检测
计算与语言
2021-12-14 v2 人工智能
机器学习
摘要
仇恨言论检测研究主要集中于纯基于内容的方法,未利用任何额外上下文。我们简要评述该任务设定的优劣。随后,我们研究通过用户过往发言对其画像,作为预测新发言是否构成仇恨言论的先验信息。为评估这一点,我们用额外的时序线数据扩充三个 Twitter 仇恨言论数据集,并将此额外上下文嵌入一个强基线模型。有前景的结果表明值得进一步研究,尽管分析因标注方案与流程的差异,以及 Twitter API 限制与数据共享政策而复杂化。
关键词
引用
@article{arxiv.2012.09090,
title = {You Are What You Tweet: Profiling Users by Past Tweets to Improve Hate Speech Detection},
author = {Prateek Chaudhry and Matthew Lease},
journal= {arXiv preprint arXiv:2012.09090},
year = {2021}
}