Tensor-to-Image:基于 Vision Transformer 的图像到图像翻译
计算机视觉与模式识别
2021-10-18 v1 人工智能
机器学习
摘要
Transformer 自首次提出以来便受到广泛关注,并具有广泛的应用。Transformer 开始接管深度学习的各个领域,Vision Transformer 论文也证明了它们可用于计算机视觉任务。在本文中,我们利用基于 Vision Transformer 的定制模型 tensor-to-image,进行图像到图像翻译。借助自注意力机制,我们的模型能够泛化并应用于不同的问题,而无需任何修改。
引用
@article{arxiv.2110.08037,
title = {Tensor-to-Image: Image-to-Image Translation with Vision Transformers},
author = {Yiğit Gündüç},
journal= {arXiv preprint arXiv:2110.08037},
year = {2021}
}