MM-Locate-News:新闻中的多模态焦点位置估计
信息检索
2022-11-16 v1
摘要
随着Web成为最具影响力的信息媒介,新闻的消费方式已发生显著变化。为分析并语境化每天发布的大量新闻,文章的地理焦点是实现基于内容的检索的重要方面。现有从文本或照片进行地理位置估计的方法与数据集,但通常被视为独立任务。然而,照片可能缺乏地理线索,而文本可包含多个位置,使得利用单一模态识别焦点位置具有挑战性。本文引入一个名为新闻多模态焦点位置(MM-Locate-News)的新数据集。我们在该新基准数据集上评估了最先进的方法,并提出了利用文本与图像内容预测新闻焦点位置的新模型。实验结果表明多模态模型优于单模态模型。
引用
@article{arxiv.2211.08042,
title = {MM-Locate-News: Multimodal Focus Location Estimation in News},
author = {Golsa Tahmasebzadeh and Eric Müller-Budack and Sherzod Hakimov and Ralph Ewerth},
journal= {arXiv preprint arXiv:2211.08042},
year = {2022}
}