中文

InsertDiffusion:通过训练自由扩散架构实现对象的身份保持可视化

计算机视觉与模式识别 2024-07-16 v1

摘要

近期图像合成的进展得益于大规模扩散模型的出现。然而,如何将现实中对象的可信可视化无缝集成到新或现有背景中,而无需大量训练,仍是一个挑战。本文引入 InsertDiffusion,一种新型、无需训练的扩散架构,高效地将对象嵌入图像中,同时保持其结构和身份特征。我们的方法利用即插即用的生成模型,无需微调,使其适用于快速且灵活的产品设计和营销可视化。我们在图像逼真度和与输入条件匹配度方面证明了其优于现有方法的性能。通过将生成任务分解为独立步骤,InsertDiffusion 提供了一个可扩展的解决方案,拓展了扩散模型在实际应用中的能力,实现保持原始对象真实性的高质量可视化。

关键词

引用

@article{arxiv.2407.10592,
  title  = {InsertDiffusion: Identity Preserving Visualization of Objects through a Training-Free Diffusion Architecture},
  author = {Phillip Mueller and Jannik Wiese and Ioan Craciun and Lars Mikelsons},
  journal= {arXiv preprint arXiv:2407.10592},
  year   = {2024}
}