对齐即一切:一种用于姿态引导视频生成的无训练增强策略
计算机视觉与模式识别
2025-06-03 v2
摘要
角色动画是计算机图形学和视觉领域中的一个变革性领域,能够从静态图像生成动态且逼真的视频动画。尽管取得了进展,但在动画中保持外观一致性仍然是一个挑战。我们的方法通过引入一个无训练框架来解决这一问题,该框架通过双重对齐策略确保生成的视频序列保留参考图像的细微特征,如体型和比例。我们将骨骼和运动先验从姿态信息中解耦,从而能够精确控制动画生成。我们的方法还改进了来自参考角色的条件控制的像素级对齐,增强了动画的时间一致性和视觉连贯性。我们的方法显著提高了视频生成的质量,而无需大型数据集或昂贵的计算资源。
引用
@article{arxiv.2408.16506,
title = {Alignment is All You Need: A Training-free Augmentation Strategy for Pose-guided Video Generation},
author = {Xiaoyu Jin and Zunnan Xu and Mingwen Ou and Wenming Yang},
journal= {arXiv preprint arXiv:2408.16506},
year = {2025}
}
备注
Accepted to CVG@ICML 2024