中文

大型预训练语言模型是否在泄露您的个人信息?

计算与语言 2022-10-21 v2 人工智能 密码学与安全

摘要

大型预训练语言模型是否在泄露您的个人信息?本文分析了预训练语言模型(PLMs)是否易于泄露个人信息。具体而言,我们以电子邮件地址的上下文或包含所有者姓名的提示来查询 PLMs。我们发现 PLMs 确实因记忆而泄露个人信息。然而,由于模型在关联方面能力较弱,攻击者提取特定个人信息的风险较低。我们希望这项工作能帮助社区更好地理解 PLMs 的隐私风险,并为使 PLMs 更安全提供新的见解。

关键词

引用

@article{arxiv.2205.12628,
  title  = {Are Large Pre-Trained Language Models Leaking Your Personal Information?},
  author = {Jie Huang and Hanyin Shao and Kevin Chen-Chuan Chang},
  journal= {arXiv preprint arXiv:2205.12628},
  year   = {2022}
}

备注

Accepted to Findings of EMNLP 2022