中文

内容保持视角的无配对图像到图像翻译综述

图像与视频处理 2025-02-18 v2 计算机视觉与模式识别

摘要

图像到图像翻译(I2I)将图像从源域转换到目标域,同时保持源内容。大多数计算机视觉应用都在图像到图像翻译领域,例如风格迁移、图像分割和照片增强。根据问题和意图应用的不同,源图像在翻译过程中内容保持的程度各不相同。从这一角度看,本文将图像到图像翻译领域的不同任务分为三大类:完全内容保持、部分内容保持和非内容保持。本文介绍了这三类任务的数据集、方法及方法结果。我们基于不同模型的架构对 I2I 方法进行分类,并分别研究每个类别。此外,我们介绍了 I2I 翻译领域的著名评估标准。具体而言,分析了近 70 种不同的 I2I 模型,并介绍和评估了超过 10 种定量评估指标和 30 个与 I2I 翻译问题相关的不同任务和数据集。将模拟图像翻译到真实图像可视为完全内容保持或部分内容保持的无监督图像到图像翻译方法的应用。因此,我们提供了一个用于 Sim-to-Real 翻译的基准,可用于评估不同方法。总体而言,由于不同应用对保持内容的程度要求不同,选择合适的 I2I 模型时更应考虑这一问题。

关键词

引用

@article{arxiv.2502.08667,
  title  = {Unpaired Image-to-Image Translation with Content Preserving Perspective: A Review},
  author = {Mehran Safayani and Behnaz Mirzapour and Hanieh aghaebrahimiyan and Nasrin Salehi and Hamid Ravaee},
  journal= {arXiv preprint arXiv:2502.08667},
  year   = {2025}
}