视觉Transformer的对抗性令牌攻击
计算机视觉与模式识别
2021-10-12 v1 密码学与安全
机器学习
摘要
与卷积网络不同,视觉Transformer依赖于基于块令牌的自注意力机制。我们通过设计一种基于块稀疏性的对抗性令牌攻击,研究了这两类模型之间的根本差异。我们利用不同块大小的令牌攻击来探测和分析Transformer以及卷积模型。我们推断,Transformer模型比卷积模型对令牌攻击更敏感,在单令牌攻击下,ResNet的鲁棒准确率比Transformer模型高出多达约。
引用
@article{arxiv.2110.04337,
title = {Adversarial Token Attacks on Vision Transformers},
author = {Ameya Joshi and Gauri Jagatap and Chinmay Hegde},
journal= {arXiv preprint arXiv:2110.04337},
year = {2021}
}