化弱点为强项:通过后门植入对深度神经网络进行水印标记
机器学习
2018-06-12 v3
摘要
深度神经网络在攻克若干公认困难的问题后近期取得诸多成功。训练这些网络计算代价高昂且需要大量训练数据。因此,出售此类预训练模型可成为一种盈利的商业模式。遗憾的是,模型一旦售出便易被复制和再分发。为避免此情况,亟需一种追踪机制以将模型标识为特定供应商的知识产权。本工作中,我们提出一种以黑盒方式对深度神经网络进行水印标记的方法。我们的方案适用于一般分类任务,并可轻易与当前学习算法结合。我们通过实验表明,此类水印对模型所设计的主任务无显著影响,并评估了我们的方案面对多种实际攻击的鲁棒性。此外,我们提供了理论分析,将我们的方法与先前关于后门的研究相关联。
引用
@article{arxiv.1802.04633,
title = {Turning Your Weakness Into a Strength: Watermarking Deep Neural Networks by Backdooring},
author = {Yossi Adi and Carsten Baum and Moustapha Cisse and Benny Pinkas and Joseph Keshet},
journal= {arXiv preprint arXiv:1802.04633},
year = {2018}
}