中文

何时不应分类:深度神经网络图像分类器上逆向工程攻击的检测

计算机视觉与模式识别 2018-11-08 v1 机器学习 机器学习

摘要

本文解决针对深度神经网络(DNN)图像分类器的逆向工程(RE)攻击的检测问题;通过查询,RE 的目的是发现分类器的决策规则。RE 可促成测试时规避攻击,其需要分类器的知识。最近,我们提出了一种相当有效的方法来检测测试时规避攻击(ADA)。在本文中,我们扩展 ADA 以检测 RE 攻击(ADA-RE)。我们证明我们的方法在"隐蔽" RE 攻击学习到足以发起有效测试时规避攻击之前成功检测到它们。

关键词

引用

@article{arxiv.1811.02658,
  title  = {When Not to Classify: Detection of Reverse Engineering Attacks on DNN Image Classifiers},
  author = {Yujia Wang and David J. Miller and George Kesidis},
  journal= {arXiv preprint arXiv:1811.02658},
  year   = {2018}
}