大型预训练语言模型是否在泄露您的个人信息?
计算与语言
2022-10-21 v2 人工智能
密码学与安全
摘要
大型预训练语言模型是否在泄露您的个人信息?本文分析了预训练语言模型(PLMs)是否易于泄露个人信息。具体而言,我们以电子邮件地址的上下文或包含所有者姓名的提示来查询 PLMs。我们发现 PLMs 确实因记忆而泄露个人信息。然而,由于模型在关联方面能力较弱,攻击者提取特定个人信息的风险较低。我们希望这项工作能帮助社区更好地理解 PLMs 的隐私风险,并为使 PLMs 更安全提供新的见解。
引用
@article{arxiv.2205.12628,
title = {Are Large Pre-Trained Language Models Leaking Your Personal Information?},
author = {Jie Huang and Hanyin Shao and Kevin Chen-Chuan Chang},
journal= {arXiv preprint arXiv:2205.12628},
year = {2022}
}
备注
Accepted to Findings of EMNLP 2022