中文

慎用标签平滑:其可成隐私护盾,亦可为模型反演攻击之催化剂

机器学习 2024-07-09 v5 密码学与安全 计算机视觉与模式识别

摘要

标签平滑——使用软标签替代硬标签——是一种被广泛采用的深度学习正则化方法,展现出诸如增强泛化与校准等多样益处。然而,其对模型隐私保护的影响此前未被探索。为填补此空白,我们研究了标签平滑对模型反演攻击(MIAs)的影响,该类攻击旨在通过利用分类器中编码的知识生成类代表性样本,从而推断其训练数据中的敏感信息。通过广泛分析,我们发现传统标签平滑会助长MIAs,从而增加模型的隐私泄露。更进一步,我们揭示带有负因子的平滑可逆转此趋势,阻碍类相关信息的提取并导致隐私保护,优于最先进的防御方法。这确立了增强模型抵御MIAs韧性的一种实用且强大的新途径。

关键词

引用

@article{arxiv.2310.06549,
  title  = {Be Careful What You Smooth For: Label Smoothing Can Be a Privacy Shield but Also a Catalyst for Model Inversion Attacks},
  author = {Lukas Struppek and Dominik Hintersdorf and Kristian Kersting},
  journal= {arXiv preprint arXiv:2310.06549},
  year   = {2024}
}

备注

Published as a conference paper at ICLR 2024