中文

CVPR 2023 文本引导视频编辑竞赛

计算机视觉与模式识别 2023-10-25 v1

摘要

人类每天观看超过十亿小时的视频。其中大部分视频是手动编辑的,这是一个繁琐的过程。然而,支持 AI 的视频生成与视频编辑正在兴起。基于 Stable Diffusion 和 Imagen 等文本到图像模型,生成式 AI 在视频任务上取得了显著进步。但由于缺乏标准基准,很难评估这些视频任务的进展。因此,我们提出了一个用于文本引导视频编辑(TGVE)的新数据集,并在 CVPR 上举办了一场竞赛,以在我们的 TGVE 数据集上评估模型。本文中,我们对竞赛进行了回顾,并描述了获胜方法。竞赛数据集可在 https://sites.google.com/view/loveucvpr23/track4 获取。

关键词

引用

@article{arxiv.2310.16003,
  title  = {CVPR 2023 Text Guided Video Editing Competition},
  author = {Jay Zhangjie Wu and Xiuyu Li and Difei Gao and Zhen Dong and Jinbin Bai and Aishani Singh and Xiaoyu Xiang and Youzeng Li and Zuwei Huang and Yuanxi Sun and Rui He and Feng Hu and Junhua Hu and Hai Huang and Hanyu Zhu and Xu Cheng and Jie Tang and Mike Zheng Shou and Kurt Keutzer and Forrest Iandola},
  journal= {arXiv preprint arXiv:2310.16003},
  year   = {2023}
}

备注

Project page: https://sites.google.com/view/loveucvpr23/track4