中文

VT-ADL:用于图像异常检测与定位的视觉 Transformer 网络

计算机视觉与模式识别 2021-11-03 v1 人工智能 机器学习

摘要

我们提出一种基于 transformer 的图像异常检测与定位网络。所提模型结合了基于重构的方法与图像块嵌入。transformer 网络的使用有助于保留嵌入图像块的空间信息,随后由高斯混合密度网络处理以定位异常区域。此外,我们还发布了 BTAD,一个真实工业异常数据集。我们的结果使用公开数据集(如 MNIST 和 MVTec)与其他最先进算法进行了比较。

关键词

引用

@article{arxiv.2104.10036,
  title  = {VT-ADL: A Vision Transformer Network for Image Anomaly Detection and Localization},
  author = {Pankaj Mishra and Riccardo Verk and Daniele Fornasier and Claudio Piciarelli and Gian Luca Foresti},
  journal= {arXiv preprint arXiv:2104.10036},
  year   = {2021}
}

备注

6 Pages, 4 images, conference published paper