中文

ACM Multimedia 2025 事件丰富图像分析大挑战赛

计算机视觉与模式识别 2025-08-27 v1

摘要

在 ACM Multimedia 2025 上举办的事件丰富图像分析(EVENTA)大挑战赛,引入了首个用于事件级多模态理解的大规模基准。传统的图像描述和检索任务主要关注对人物、物体和场景的表面级识别,往往忽略了定义真实世界事件的上下文和语义维度。EVENTA 通过整合上下文、时间和语义信息来捕捉图像背后的谁、何时、何地、什么以及为什么,从而弥补了这一差距。该挑战赛基于 OpenEvents V1 数据集,设有两个赛道:事件丰富图像检索与描述,以及基于事件的图像检索。共有来自六个国家的 45 支队伍参赛,通过公开测试和私有测试阶段进行评估,以确保公平性和可复现性。排名前三的队伍受邀在 ACM Multimedia 2025 上展示他们的解决方案。EVENTA 为上下文感知、叙事驱动的多媒体人工智能奠定了基础,可应用于新闻、媒体分析、文化存档和可访问性等领域。有关挑战赛的更多详细信息,请访问官方主页:https://ltnghia.github.io/eventa/eventa-2025。

关键词

引用

@article{arxiv.2508.18904,
  title  = {Event-Enriched Image Analysis Grand Challenge at ACM Multimedia 2025},
  author = {Thien-Phuc Tran and Minh-Quang Nguyen and Minh-Triet Tran and Tam V. Nguyen and Trong-Le Do and Duy-Nam Ly and Viet-Tham Huynh and Khanh-Duy Le and Mai-Khiem Tran and Trung-Nghia Le},
  journal= {arXiv preprint arXiv:2508.18904},
  year   = {2025}
}

备注

ACM Multimedia 2025