中文

FashionFlow:利用扩散模型从静态图像合成动态时尚视频

计算机视觉与模式识别 2024-01-23 v2 人工智能

摘要

本研究介绍了一种名为 FashionFlow 的新型图像到视频生成器,用于生成时尚视频。通过利用扩散模型,我们能够从静态时尚图像创建短视频。我们的方法包括开发与扩散模型相关并相互连接的组件,从而生成与条件图像对齐的高保真视频。这些组件包括使用伪三维卷积层来高效地生成视频。VAE 和 CLIP 编码器从静态图像中捕获关键特征,以在全局层面对扩散模型进行条件化。我们的研究展示了成功合成时尚视频,其中模特从多个角度摆姿势,展示服装的合身度与外观。我们的发现对改善和增强在线时尚行业的购物体验具有很大前景。

关键词

引用

@article{arxiv.2310.00106,
  title  = {FashionFlow: Leveraging Diffusion Models for Dynamic Fashion Video Synthesis from Static Imagery},
  author = {Tasin Islam and Alina Miron and XiaoHui Liu and Yongmin Li},
  journal= {arXiv preprint arXiv:2310.00106},
  year   = {2024}
}