中文

视觉 Transformer 在医学影像中的应用:综述

计算机视觉与模式识别 2022-11-21 v1 人工智能

摘要

Transformer 是一种由基于注意力的编码器–解码器架构组成的模型,在自然语言处理(NLP)领域已颇为流行,并最近影响了计算机视觉(CV)领域。鉴于计算机视觉与医学影像之间的相似性,研究者们探讨了一个问题:Transformer 对计算机视觉的影响能否迁移到医学影像中?本文试图通过以下方式对 Transformer 在医学影像中的应用提供全面且最新的综述:描述 Transformer 模型并将其与多种卷积神经网络(CNN)进行比较,详述基于 Transformer 的医学图像分类、分割、配准与重建方法(重点关注图像模态),并将最先进 Transformer 架构在标准医学数据集上的性能与表现最佳的 CNN 进行比较。

关键词

引用

@article{arxiv.2211.10043,
  title  = {Vision Transformers in Medical Imaging: A Review},
  author = {Emerald U. Henry and Onyeka Emebob and Conrad Asotie Omonhinmin},
  journal= {arXiv preprint arXiv:2211.10043},
  year   = {2022}
}