以外部标签与领域内预训练增强多模态 Transformer:仇恨表情包挑战赛夺冠方案
计算与语言
2020-12-16 v1 计算机视觉与模式识别
摘要
仇恨表情包检测是近期提出的一个新研究领域,需要同时理解表情包的视觉与语言内容以及某些背景知识才能在该任务上表现良好。本技术报告总结了 2020 年仇恨表情包检测挑战赛(Hateful Meme Detection Challenge 2020)的冠军方案,该方案扩展了最先进的视觉-语言 Transformer 以应对此问题。在报告末尾,我们也指出了当前方法的不足以及可能的改进方向。
引用
@article{arxiv.2012.08290,
title = {Enhance Multimodal Transformer With External Label And In-Domain Pretrain: Hateful Meme Challenge Winning Solution},
author = {Ron Zhu},
journal= {arXiv preprint arXiv:2012.08290},
year = {2020}
}