CineVerse:电影场景构图的一致关键帧合成
计算机视觉与模式识别
2025-04-29 v1
摘要
我们提出CineVerse,一个用于电影场景构图任务的新框架。类似于传统的多帧生成,我们的任务强调跨帧的一致性和连续性。然而,我们的任务也致力于解决电影制作中固有的挑战,如多个人物、复杂的相互作用以及视觉电影特效。为了训练模型,我们首先创建了CineVerse数据集。我们使用该数据集训练我们提出的两阶段方法。首先,我们针对特定任务的指令,提示大型语言模型(LLM)输入高层次的场景描述,生成整个场景和人物的详细计划,以及每个镜头的细节。然后,我们微调文本到图像生成模型,以合成高质量的视觉关键帧。实验结果表明,CineVerse在生成视觉连贯且情境丰富的电影场景方面取得了有前景的改进,为进一步探索电影视频合成铺平了道路。
引用
@article{arxiv.2504.19894,
title = {CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition},
author = {Quynh Phung and Long Mai and Fabian David Caba Heilbron and Feng Liu and Jia-Bin Huang and Cusuh Ham},
journal= {arXiv preprint arXiv:2504.19894},
year = {2025}
}
备注
link website: https://cinevers.github.io/