中文

PI-Trans:基于并行ConvMLP与隐式变换GAN的跨视角图像翻译

计算机视觉与模式识别 2023-03-07 v2

摘要

对于语义引导的跨视角图像翻译,学习从源视角图像中何处采样像素以及由目标视角语义图引导将其重分配到何处至关重要,尤其在源图像与目标图像之间重叠很少或视角差异剧烈时。因此,不仅需要编码源视角图像和目标视角语义图中像素间的长程依赖,还需翻译这些学到的依赖。为此,我们提出了一种新颖的生成对抗网络 PI-Trans,它主要由一个新颖的 Parallel-ConvMLP 模块和一个在多语义层级上的 Implicit Transformation 模块构成。大量实验结果表明,在两个具挑战性的数据集上,PI-Trans 以大幅优势相比最先进方法取得了最佳的定性与定量性能。源代码见 https://github.com/Amazingren/PI-Trans。

关键词

引用

@article{arxiv.2207.04242,
  title  = {PI-Trans: Parallel-ConvMLP and Implicit-Transformation Based GAN for Cross-View Image Translation},
  author = {Bin Ren and Hao Tang and Yiming Wang and Xia Li and Wei Wang and Nicu Sebe},
  journal= {arXiv preprint arXiv:2207.04242},
  year   = {2023}
}

备注

5 pages, 5 figures