MIMIC:多模态伊斯兰教仇恨表情识别与分类
计算机视觉与模式识别
2024-12-03 v1
摘要
伊斯兰教仇恨言论在表情中逐渐出现,特点是利用文本和图像呈现看似幽默但传递仇恨情绪的语境依赖性和修辞性信息。本工作提出了一个新型数据集,并针对识别和分类其中的反穆斯林仇恨,提出基于视觉-语言转换器(ViLT)的分类器。我们的模型利用表情图像和嵌入文本之间的联合模态嵌入,以捕捉独特于表情文化的仇恨叙事,实现高检测准确率和良好的可互操作性。
引用
@article{arxiv.2412.00681,
title = {MIMIC: Multimodal Islamophobic Meme Identification and Classification},
author = {S M Jishanul Islam and Sahid Hossain Mustakim and Sadia Ahmmed and Md. Faiyaz Abdullah Sayeedi and Swapnil Khandoker and Syed Tasdid Azam Dhrubo and Nahid Hossain},
journal= {arXiv preprint arXiv:2412.00681},
year = {2024}
}
备注
Accepted (Poster) - NeurIPS 2024 Workshop MusIML