利用对抗样本的一种惊人简单的防御方法
密码学与安全
2020-06-04 v3 计算机视觉与模式识别
机器学习
摘要
我介绍了一种非常简单的防御对抗样本的方法。基本思想是在测试时提高 ReLU 函数的斜率。在 MNIST 和 CIFAR-10 数据集上的实验证明了所提防御在有无目标攻击设定下针对多种强攻击的有效性。虽然其效果或许不如最先进的对抗防御,但该方法可为理解和缓解对抗攻击提供见解。它也可与其他防御结合使用。
引用
@article{arxiv.2004.13013,
title = {Harnessing adversarial examples with a surprisingly simple defense},
author = {Ali Borji},
journal= {arXiv preprint arXiv:2004.13013},
year = {2020}
}