面向复杂数据的分层视频生成
计算机视觉与模式识别
2021-06-08 v1
摘要
视频通常可以通过先勾勒场景的全局描述,然后添加局部细节来创建。受此启发,我们提出了一种遵循由粗到细方法的分层视频生成模型。首先,我们的模型生成一个低分辨率视频,建立全局场景结构,然后由层次中的后续级别进行细化。我们在视频的部分视图上顺序训练层次中的每个级别。这降低了我们生成模型的计算复杂度,使其能够扩展到高分辨率视频(超过几帧)。我们在Kinetics-600和BDD100K上验证了我们的方法,为此我们训练了一个三级模型,能够生成256x256、48帧的视频。
引用
@article{arxiv.2106.02719,
title = {Hierarchical Video Generation for Complex Data},
author = {Lluis Castrejon and Nicolas Ballas and Aaron Courville},
journal= {arXiv preprint arXiv:2106.02719},
year = {2021}
}