中文

视觉Transformer的对抗性令牌攻击

计算机视觉与模式识别 2021-10-12 v1 密码学与安全 机器学习

摘要

与卷积网络不同,视觉Transformer依赖于基于块令牌的自注意力机制。我们通过设计一种基于块稀疏性的对抗性令牌攻击,研究了这两类模型之间的根本差异。我们利用不同块大小的令牌攻击来探测和分析Transformer以及卷积模型。我们推断,Transformer模型比卷积模型对令牌攻击更敏感,在单令牌攻击下,ResNet的鲁棒准确率比Transformer模型高出多达约30%30\%

关键词

引用

@article{arxiv.2110.04337,
  title  = {Adversarial Token Attacks on Vision Transformers},
  author = {Ameya Joshi and Gauri Jagatap and Chinmay Hegde},
  journal= {arXiv preprint arXiv:2110.04337},
  year   = {2021}
}