中文

面向复杂数据的分层视频生成

计算机视觉与模式识别 2021-06-08 v1

摘要

视频通常可以通过先勾勒场景的全局描述,然后添加局部细节来创建。受此启发,我们提出了一种遵循由粗到细方法的分层视频生成模型。首先,我们的模型生成一个低分辨率视频,建立全局场景结构,然后由层次中的后续级别进行细化。我们在视频的部分视图上顺序训练层次中的每个级别。这降低了我们生成模型的计算复杂度,使其能够扩展到高分辨率视频(超过几帧)。我们在Kinetics-600和BDD100K上验证了我们的方法,为此我们训练了一个三级模型,能够生成256x256、48帧的视频。

关键词

引用

@article{arxiv.2106.02719,
  title  = {Hierarchical Video Generation for Complex Data},
  author = {Lluis Castrejon and Nicolas Ballas and Aaron Courville},
  journal= {arXiv preprint arXiv:2106.02719},
  year   = {2021}
}