中文

你推什么你就是什么:用历史推文对用户画像以改进仇恨言论检测

计算与语言 2021-12-14 v2 人工智能 机器学习

摘要

仇恨言论检测研究主要集中于纯基于内容的方法,未利用任何额外上下文。我们简要评述该任务设定的优劣。随后,我们研究通过用户过往发言对其画像,作为预测新发言是否构成仇恨言论的先验信息。为评估这一点,我们用额外的时序线数据扩充三个 Twitter 仇恨言论数据集,并将此额外上下文嵌入一个强基线模型。有前景的结果表明值得进一步研究,尽管分析因标注方案与流程的差异,以及 Twitter API 限制与数据共享政策而复杂化。

关键词

引用

@article{arxiv.2012.09090,
  title  = {You Are What You Tweet: Profiling Users by Past Tweets to Improve Hate Speech Detection},
  author = {Prateek Chaudhry and Matthew Lease},
  journal= {arXiv preprint arXiv:2012.09090},
  year   = {2021}
}