中文

面向基于 Diffusion 的视频编辑的中性编辑框架

计算机视觉与模式识别 2023-12-13 v1

摘要

基于 Diffusion 框架,文本条件图像编辑已在多种类型的编辑中取得成功。遗憾的是,这种成功未能延伸至视频领域,后者依然充满挑战。现有的视频编辑系统仍局限于刚性类型编辑,如风格迁移和物体叠加。为此,本文提出 Neutral Editing (NeuEdit) 框架,通过改变视频中人物/物体的运动来实现复杂的非刚性编辑,这是此前从未尝试过的。NeuEdit 引入了“中和”概念,以模型无关的方式,仅利用输入视频和文本,在无需任何其他辅助手段(如视觉掩码、视频字幕)的情况下,增强基于 Diffusion 编辑系统的微调-编辑过程。在大量视频上的广泛实验证明了 NeuEdit 框架的适应性与有效性。本项目网站见:https://neuedit.github.io

关键词

引用

@article{arxiv.2312.06708,
  title  = {Neutral Editing Framework for Diffusion-based Video Editing},
  author = {Sunjae Yoon and Gwanhyeong Koo and Ji Woo Hong and Chang D. Yoo},
  journal= {arXiv preprint arXiv:2312.06708},
  year   = {2023}
}

备注

18 pages, 14 figures