用于高分辨率逼真图像翻译的多曲线翻译器
计算机视觉与模式识别
2022-07-12 v2
摘要
主流的图像到图像翻译方法基于全卷积网络,其提取并翻译图像特征而后重建图像。然而,在处理高分辨率图像时它们具有不可接受的计算成本。为此,我们提出多曲线翻译器(MCT),其不仅为对应输入像素预测翻译后像素,也为其邻域像素预测。并且若一幅高分辨率图像被下采样为其低分辨率版本,所丢失的像素正是其余像素的邻域像素。因此 MCT 使得仅将下采样图像输入网络即可完成全分辨率图像的映射成为可能,从而大幅降低计算成本。此外,MCT 是一种插件式方法,利用现有基础模型并仅需替换其输出层。实验表明,MCT 变体可实时处理 4K 图像,并在多种逼真图像到图像翻译任务上取得与基础模型相当甚至更优的性能。
引用
@article{arxiv.2203.07756,
title = {Multi-Curve Translator for High-Resolution Photorealistic Image Translation},
author = {Yuda Song and Hui Qian and Xin Du},
journal= {arXiv preprint arXiv:2203.07756},
year = {2022}
}