多模态讽刺检测综述
计算与语言
2024-10-25 v1
摘要
讽刺是一种修辞手法,用于表达话语字面意义的相反意义。讽刺在社交媒体和其他计算机媒介沟通中广泛使用,激发了使用计算模型自动识别它的需求。虽然大多数讽刺检测方法都只在文本上进行,但讽刺检测通常需要语调、面部表情和上下文图像中存在的额外信息。这导致了多模态模型的出现,为在音频、图像、文本和视频等多个模态中检测讽刺提供了可能。本文present了首个关于多模态讽刺检测(henceforth MSD)的全面综述。我们综述了2018至2023年间关于该主题的论文,讨论用于该任务的模型和数据集。我们也present了MSD的未来研究方向。
引用
@article{arxiv.2410.18882,
title = {A Survey of Multimodal Sarcasm Detection},
author = {Shafkat Farabi and Tharindu Ranasinghe and Diptesh Kanojia and Yu Kong and Marcos Zampieri},
journal= {arXiv preprint arXiv:2410.18882},
year = {2024}
}
备注
Published in the Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence Survey Track. Pages 8020-8028