中文

针对所有对抗性 $l_p$-扰动($p\geq 1$)的可证明鲁棒性

机器学习 2020-04-27 v2 密码学与安全 机器学习

摘要

近年来,人们提出了若干对抗攻击与防御方法。看似鲁棒的模型在面临更复杂的攻击时往往被证明并非鲁棒。摆脱这一困境的一种途径是可证明的鲁棒性保证。虽然针对特定 lpl_p-扰动模型的可证明鲁棒模型已被开发,我们指出它们并不提供针对其他 lql_q-扰动的任何保证。我们提出了一种用于ReLU网络的新正则化方案MMR-Universal,其强制实现对 l1l_1- 与 ll_\infty-扰动的鲁棒性,并展示了它如何带来首个针对任意 lpl_p-范数(p1p\geq 1)的可证明鲁棒模型。

关键词

引用

@article{arxiv.1905.11213,
  title  = {Provable robustness against all adversarial $l_p$-perturbations for $p\geq 1$},
  author = {Francesco Croce and Matthias Hein},
  journal= {arXiv preprint arXiv:1905.11213},
  year   = {2020}
}