中文

用于图像着色的 ViT-Inception-GAN

计算机视觉与模式识别 2021-06-14 v1 机器学习

摘要

随着各类机器学习技术的显著进步与计算能力的可得,涉及图像着色的研究日益受到研究者的密切关注。传统上,图像着色一直是一项复杂任务,在色度信息赋予过程中具有相当程度的自由度。在我们提出的方法中,我们尝试使用视觉 Transformer - Inception - 生成对抗网络(ViT-I-GAN)对图像进行着色,其生成器中具有 Inception-v3 融合嵌入。为构建稳定且鲁棒的网络,我们使用视觉 Transformer(ViT)作为判别器。我们在 Unsplash 与 COCO 数据集上训练模型,以展示 Inception-v3 嵌入带来的改进。我们比较了带与不带 Inception-v3 嵌入的 ViT-GAN 之间的结果。

关键词

引用

@article{arxiv.2106.06321,
  title  = {ViT-Inception-GAN for Image Colourising},
  author = {Tejas Bana and Jatan Loya and Siddhant Kulkarni},
  journal= {arXiv preprint arXiv:2106.06321},
  year   = {2021}
}

备注

12 pages