勿恨我:检测语码转换语言中的仇恨诱导表情包
机器学习
2022-04-26 v1 计算与语言
社会与信息网络
摘要
社交媒体用户数量的增长导致了线上仇恨内容的增加。在如印度等多语言国家,这些令人厌恶的帖子来自语码转换语言的异常混合。此类仇恨言论借助图像形成“表情包(Memes)”,对人类心智造成持久影响。本文中,我们承担了基于多模态数据的仇恨与攻击性检测任务,即包含语码转换语言文本的图像(表情包)。我们首先提出一个新颖的三重标注印度政治表情包(IPM)数据集,其包含印度独立后各类政治事件的表情包,并分为三个不同类别。我们还提出了一种基于双通道CNN结合LSTM的模型,使用CNN处理图像、LSTM处理文本,在此任务上取得了最先进的结果。
引用
@article{arxiv.2204.11356,
title = {Hate Me Not: Detecting Hate Inducing Memes in Code Switched Languages},
author = {Kshitij Rajput and Raghav Kapoor and Kaushal Rai and Preeti Kaur},
journal= {arXiv preprint arXiv:2204.11356},
year = {2022}
}
备注
To be published in 2022 Americas Conference on Information Systems