VT-ADL:用于图像异常检测与定位的视觉 Transformer 网络
计算机视觉与模式识别
2021-11-03 v1 人工智能
机器学习
摘要
我们提出一种基于 transformer 的图像异常检测与定位网络。所提模型结合了基于重构的方法与图像块嵌入。transformer 网络的使用有助于保留嵌入图像块的空间信息,随后由高斯混合密度网络处理以定位异常区域。此外,我们还发布了 BTAD,一个真实工业异常数据集。我们的结果使用公开数据集(如 MNIST 和 MVTec)与其他最先进算法进行了比较。
引用
@article{arxiv.2104.10036,
title = {VT-ADL: A Vision Transformer Network for Image Anomaly Detection and Localization},
author = {Pankaj Mishra and Riccardo Verk and Daniele Fornasier and Claudio Piciarelli and Gian Luca Foresti},
journal= {arXiv preprint arXiv:2104.10036},
year = {2021}
}
备注
6 Pages, 4 images, conference published paper