中文

Tensor-to-Image:基于 Vision Transformer 的图像到图像翻译

计算机视觉与模式识别 2021-10-18 v1 人工智能 机器学习

摘要

Transformer 自首次提出以来便受到广泛关注,并具有广泛的应用。Transformer 开始接管深度学习的各个领域,Vision Transformer 论文也证明了它们可用于计算机视觉任务。在本文中,我们利用基于 Vision Transformer 的定制模型 tensor-to-image,进行图像到图像翻译。借助自注意力机制,我们的模型能够泛化并应用于不同的问题,而无需任何修改。

关键词

引用

@article{arxiv.2110.08037,
  title  = {Tensor-to-Image: Image-to-Image Translation with Vision Transformers},
  author = {Yiğit Gündüç},
  journal= {arXiv preprint arXiv:2110.08037},
  year   = {2021}
}