中文

形状感知的文本驱动分层视频编辑

计算机视觉与模式识别 2023-01-31 v1 图像与视频处理

摘要

时间一致性对视频编辑应用至关重要。现有的视频分层表示方法可将编辑一致地传播到每一帧。然而,由于使用固定的 UV 映射场作为纹理图集的限制,这些方法只能编辑物体外观而非物体形状变化。我们提出一种形状感知、文本驱动的视频编辑方法来应对该挑战。为处理视频编辑中的形状变化,我们首先将输入帧与编辑关键帧之间的形变场传播到所有帧。随后利用预训练的文本条件扩散模型作为引导,以细化形状畸变并补全不可见区域。实验结果表明,我们的方法能实现形状感知的一致视频编辑,并优于当前最优方法。

关键词

引用

@article{arxiv.2301.13173,
  title  = {Shape-aware Text-driven Layered Video Editing},
  author = {Yao-Chih Lee and Ji-Ze Genevieve Jang and Yi-Ting Chen and Elizabeth Qiu and Jia-Bin Huang},
  journal= {arXiv preprint arXiv:2301.13173},
  year   = {2023}
}

备注

Project page: https://text-video-edit.github.io/