关于随机激活剪枝的混淆梯度攻击的勘误
机器学习
2020-10-02 v1 机器学习
摘要
随机激活剪枝(SAP)(Dhillon 等人,2018)是一种针对对抗样本的防御方法,曾被“混淆梯度”论文(Athalye 等人,2018)攻击并发现已被攻破。我们发现其重新实现中存在一个人为削弱 SAP 的缺陷。当 SAP 被正确应用时,所提出的攻击并不有效。然而,我们表明 BPDA 攻击技术的一种新用法仍可将 SAP 的准确率降至 0.1%。
引用
@article{arxiv.2010.00071,
title = {Erratum Concerning the Obfuscated Gradients Attack on Stochastic Activation Pruning},
author = {Guneet S. Dhillon and Nicholas Carlini},
journal= {arXiv preprint arXiv:2010.00071},
year = {2020}
}