针对所有对抗性 $l_p$-扰动($p\geq 1$)的可证明鲁棒性
机器学习
2020-04-27 v2 密码学与安全
机器学习
摘要
近年来,人们提出了若干对抗攻击与防御方法。看似鲁棒的模型在面临更复杂的攻击时往往被证明并非鲁棒。摆脱这一困境的一种途径是可证明的鲁棒性保证。虽然针对特定 -扰动模型的可证明鲁棒模型已被开发,我们指出它们并不提供针对其他 -扰动的任何保证。我们提出了一种用于ReLU网络的新正则化方案MMR-Universal,其强制实现对 - 与 -扰动的鲁棒性,并展示了它如何带来首个针对任意 -范数()的可证明鲁棒模型。
引用
@article{arxiv.1905.11213,
title = {Provable robustness against all adversarial $l_p$-perturbations for $p\geq 1$},
author = {Francesco Croce and Matthias Hein},
journal= {arXiv preprint arXiv:1905.11213},
year = {2020}
}