图像反转:从GAN到扩散模型及更广泛的综述
计算机视觉与模式识别
2025-02-18 v1
摘要
图像反转是生成模型中的基础任务,旨在将图像映射回其潜在表示,以支持编辑、修复和风格迁移等下游应用。本文对图像反转技术的最新进展进行了全面综述,重点关注两大范式:生成对抗网络(GAN)反转和扩散模型反转。我们根据优化方法对这些技术进行分类。对于GAN反转,我们系统地将现有方法分为基于编码器的方法、潜在优化方法和混合方法,分析其理论基础、技术创新和实际权衡。对于扩散模型反转,我们探索了免训练策略、微调方法和额外可训练模块的设计,突出了它们的独特优势和局限性。此外,我们讨论了几种流行的下游应用和超出图像任务的新兴应用,识别了当前挑战和未来研究方向。通过综合最新发展,本文旨在为研究人员和实践者提供有价值的参考资源,促进图像反转领域的进一步进展。我们通过https://github.com/RyanChenYN/ImageInversion跟踪最新工作。
引用
@article{arxiv.2502.11974,
title = {Image Inversion: A Survey from GANs to Diffusion and Beyond},
author = {Yinan Chen and Jiangning Zhang and Yali Bi and Xiaobin Hu and Teng Hu and Zhucun Xue and Ran Yi and Yong Liu and Ying Tai},
journal= {arXiv preprint arXiv:2502.11974},
year = {2025}
}
备注
10 pages, 2 figures