腾讯多模态广告视频理解挑战赛概述
计算机视觉与模式识别
2021-09-17 v1
摘要
多模态广告视频理解挑战赛是首个旨在全面理解广告视频的宏大挑战赛。我们的挑战赛包含两项任务:时间维度上的视频结构化与多模态视频分类。它要求参与者基于细粒度且与广告相关的类别体系,准确预测每个场景的场景边界和多标签类别。因此,我们的任务相较以往具有四个区别性特征:广告领域、多模态信息、时间分割和多标签分类。它将推进广告视频理解的基础,并对视频推荐等诸多广告应用产生重要影响。本文介绍了我们挑战赛的概述,包括广告视频背景、任务与数据集的详尽描述、评估协议以及我们提出的基线。通过对基线关键组件进行消融,我们旨在揭示该任务的主要挑战,并为该领域未来研究提供有用指导。本文给出了我们挑战赛概述的扩展版本。数据集将在 https://algo.qq.com/ 公开可用。
引用
@article{arxiv.2109.07951,
title = {Overview of Tencent Multi-modal Ads Video Understanding Challenge},
author = {Zhenzhi Wang and Liyu Wu and Zhimin Li and Jiangfeng Xiong and Qinglin Lu},
journal= {arXiv preprint arXiv:2109.07951},
year = {2021}
}
备注
8-page extended version of our challenge paper in ACM MM 2021. It presents the overview of grand challenge "Multi-modal Ads Video Understanding" in ACM MM 2021. Our grand challenge is also the Tencent Advertising Algorithm Competition (TAAC) 2021