中文

深度模型交易的可撤销后门

密码学与安全 2024-08-02 v1 计算机视觉与模式识别

摘要

深度模型正在被应用于诸多领域,已成为一种新的重要数字产品。与此同时,先前的研究表明,深度模型对后门攻击十分脆弱,这类攻击会在触发器出现时返回攻击者期望的结果。后门攻击严重破坏了深度模型的可信度。在本文中,我们将这种深度模型的弱点转化为优势,提出一种 novel 可撤销后门及深度模型交易场景。具体而言,我们旨在在不降低模型性能的前提下使深度模型受感染,同时能够轻易地在不重新训练模型的情况下将受感染的模型“解毒”。我们设计特定的掩码矩阵来管理模型的内部特征图。这些掩码矩阵可用于去除后门。可撤销后门可用于深度模型交易场景中。卖家训练带有可撤销后门的模型作为试用版。买家支付押金给卖家并获得模型的试用版。如果买家对试用版满意,他们将支付最终款项给卖家,卖家则向买家发送掩码矩阵以撤销可撤销后门。我们通过各种数据集和网络架构展示了可撤销后门的可行性和鲁棒性。

关键词

引用

@article{arxiv.2408.00255,
  title  = {Revocable Backdoor for Deep Model Trading},
  author = {Yiran Xu and Nan Zhong and Zhenxing Qian and Xinpeng Zhang},
  journal= {arXiv preprint arXiv:2408.00255},
  year   = {2024}
}

备注

to appear in ECAI 2024