多模态发布内容中仇恨言论检测的探索
计算机视觉与模式识别
2019-10-10 v1 计算与语言
摘要
在这项工作中,我们针对由文本和图像构成的多模态发布内容中的仇恨言论检测问题。我们从 Twitter 收集并标注了一个大规模数据集 MMHS150K,并提出了不同联合分析文本和视觉信息以进行仇恨言论检测的模型,将其与单模态检测进行比较。我们提供了定量和定性结果并分析了所提任务的挑战。我们发现,尽管图像对仇恨言论检测任务有用,但当前多模态模型无法超越仅分析文本的模型。我们讨论了原因并开放该领域和数据集以供进一步研究。
引用
@article{arxiv.1910.03814,
title = {Exploring Hate Speech Detection in Multimodal Publications},
author = {Raul Gomez and Jaume Gibert and Lluis Gomez and Dimosthenis Karatzas},
journal= {arXiv preprint arXiv:1910.03814},
year = {2019}
}