将任意物体置入任意视频
计算机视觉与模式识别
2024-02-23 v1
摘要
可控视频编辑在多种应用中展现出巨大潜力,特别是在难以或成本高昂地拍摄或重拍真实世界视频的场景中。本文介绍了一种名为 Place-Anything 的新型高效系统,该系统仅基于目标物体或元素的图片或文本描述,即可将任意物体插入到任意视频中。该系统包含三个模块:3D 生成、视频重建和 3D 目标插入。这种集成方法通过无缝插入逼真物体,为制作和编辑高质量视频提供了一种高效且有效的解决方案。通过用户研究,我们证明该系统仅需一张物体照片即可轻松将任意物体置入任意视频。我们的演示视频见 https://youtu.be/afXqgLLRnTE。请访问我们的项目页面 https://place-anything.github.io 获取访问权限。
引用
@article{arxiv.2402.14316,
title = {Place Anything into Any Video},
author = {Ziling Liu and Jinyu Yang and Mingqi Gao and Feng Zheng},
journal= {arXiv preprint arXiv:2402.14316},
year = {2024}
}