用于动态视频缩略图生成的句子引导时间调制
计算机视觉与模式识别
2020-09-01 v1
摘要
我们考虑句子指定的动态视频缩略图生成问题。给定输入视频和用户查询句子,目标是生成既提供视频内容预览又在语义上对应于该句子的视频缩略图。本文提出一种句子引导时间调制(SGTM)机制,利用句子嵌入来调制视频缩略图生成网络的归一化时间激活。与现有的使用循环架构的先进方法不同,我们提出了一种非循环框架,其结构简单并允许更多的并行化。在大规模数据集上的大量实验与分析证明了我们框架的有效性。
引用
@article{arxiv.2008.13362,
title = {Sentence Guided Temporal Modulation for Dynamic Video Thumbnail Generation},
author = {Mrigank Rochan and Mahesh Kumar Krishna Reddy and Yang Wang},
journal= {arXiv preprint arXiv:2008.13362},
year = {2020}
}
备注
Accepted to BMVC 2020