中文

ViClaim:用于视频中自动化主张检测的多语言多标签数据集

计算与语言 2025-10-13 v3

摘要

视频内容作为一种通信和误information传播的媒介日益增长,凸显了针对多语言和多主题环境中主张分析的有效工具的紧迫需求。现有的误information检测工作主要集中在书面文本,留下了大量未能解决的难题——即处理视频转录中口语文本的复杂性。我们介绍 ViClaim,一个包含 1,798 个标注视频转录的数据集,覆盖三个语言(英语、德语、西班牙语)和六个主题。每个句子都标注为三个主张相关类别:可核查、不可核查或意见。我们开发了自定义标注工具以促进这一复杂的标注过程。使用最先进的多语言语言模型进行实验,显示出在交叉验证中表现良好(宏平均 F1 最高可达 0.896),但在针对未见主题的泛化能力方面存在挑战,尤其是针对不同领域。我们发现视频转录中的主张检测具有复杂性。ViClaim 为在基于视频的通信中推进误information检测提供了稳健的基础,解决了多模态分析中的关键缺口。

关键词

引用

@article{arxiv.2504.12882,
  title  = {ViClaim: A Multilingual Multilabel Dataset for Automatic Claim Detection in Videos},
  author = {Patrick Giedemann and Pius von Däniken and Jan Deriu and Alvaro Rodrigo and Anselmo Peñas and Mark Cieliebak},
  journal= {arXiv preprint arXiv:2504.12882},
  year   = {2025}
}