YouMakeup VQA 挑战赛:面向特定领域视频中的细粒度动作理解
计算机视觉与模式识别
2020-04-14 v1 机器学习
摘要
YouMakeup VQA 挑战赛 2020 的目标是为特定领域视频(例如化妆教学视频)中的细粒度动作理解提供一个通用基准。我们提出了两个新颖的问答任务来评估模型的细粒度动作理解能力。第一个任务是面部图像排序,旨在理解以自然语言表述的、作用于面部对象的不同动作的视觉效应。第二个任务是步骤排序,旨在衡量未剪辑视频与多句文本之间的跨模态语义对齐。在本文中,我们介绍了挑战赛指南、所使用的数据集,以及基线模型在这两个提出任务上的表现。基线代码与模型发布于 \url{https://github.com/AIM3-RUC/YouMakeup_Baseline}。
引用
@article{arxiv.2004.05573,
title = {YouMakeup VQA Challenge: Towards Fine-grained Action Understanding in Domain-Specific Videos},
author = {Shizhe Chen and Weiying Wang and Ludan Ruan and Linli Yao and Qin Jin},
journal= {arXiv preprint arXiv:2004.05573},
year = {2020}
}
备注
CVPR LVVU Workshop 2020 YouMakeup VQA Challenge