FashionFlow:利用扩散模型从静态图像合成动态时尚视频
计算机视觉与模式识别
2024-01-23 v2 人工智能
摘要
本研究介绍了一种名为 FashionFlow 的新型图像到视频生成器,用于生成时尚视频。通过利用扩散模型,我们能够从静态时尚图像创建短视频。我们的方法包括开发与扩散模型相关并相互连接的组件,从而生成与条件图像对齐的高保真视频。这些组件包括使用伪三维卷积层来高效地生成视频。VAE 和 CLIP 编码器从静态图像中捕获关键特征,以在全局层面对扩散模型进行条件化。我们的研究展示了成功合成时尚视频,其中模特从多个角度摆姿势,展示服装的合身度与外观。我们的发现对改善和增强在线时尚行业的购物体验具有很大前景。
引用
@article{arxiv.2310.00106,
title = {FashionFlow: Leveraging Diffusion Models for Dynamic Fashion Video Synthesis from Static Imagery},
author = {Tasin Islam and Alina Miron and XiaoHui Liu and Yongmin Li},
journal= {arXiv preprint arXiv:2310.00106},
year = {2024}
}