中文

勿恨我:检测语码转换语言中的仇恨诱导表情包

机器学习 2022-04-26 v1 计算与语言 社会与信息网络

摘要

社交媒体用户数量的增长导致了线上仇恨内容的增加。在如印度等多语言国家,这些令人厌恶的帖子来自语码转换语言的异常混合。此类仇恨言论借助图像形成“表情包(Memes)”,对人类心智造成持久影响。本文中,我们承担了基于多模态数据的仇恨与攻击性检测任务,即包含语码转换语言文本的图像(表情包)。我们首先提出一个新颖的三重标注印度政治表情包(IPM)数据集,其包含印度独立后各类政治事件的表情包,并分为三个不同类别。我们还提出了一种基于双通道CNN结合LSTM的模型,使用CNN处理图像、LSTM处理文本,在此任务上取得了最先进的结果。

关键词

引用

@article{arxiv.2204.11356,
  title  = {Hate Me Not: Detecting Hate Inducing Memes in Code Switched Languages},
  author = {Kshitij Rajput and Raghav Kapoor and Kaushal Rai and Preeti Kaur},
  journal= {arXiv preprint arXiv:2204.11356},
  year   = {2022}
}

备注

To be published in 2022 Americas Conference on Information Systems