LatticeGen:一种将生成文本隐藏于格中以供云端隐私感知生成的协作框架
计算与语言
2024-04-08 v5
摘要
在当前云端使用大语言模型(LLM)进行提示生成的用户–服务器交互范式中,服务器完全控制生成过程,这使得希望将生成文本保留给自己的用户毫无选择。我们提出 LatticeGen,一种协作框架,其中服务器仍处理大部分计算,而用户控制采样操作。其核心思想是:真实生成的序列由用户混入噪声词元,并隐藏于加噪格中。考虑到假设恶意服务器可能发起的攻击以及用户如何防御,我们提出了重复束搜索攻击与混合噪声方案。在实验中,我们将 LatticeGen 应用于保护提示与生成内容。结果表明,尽管加噪格会降低生成质量,LatticeGen 在强攻击下仍成功保护了真实生成内容至显著程度(按 BERTScore 衡量,超过 50% 的语义保持隐藏)。
引用
@article{arxiv.2309.17157,
title = {LatticeGen: A Cooperative Framework which Hides Generated Text in a Lattice for Privacy-Aware Generation on Cloud},
author = {Mengke Zhang and Tianxing He and Tianle Wang and Lu Mi and Fatemehsadat Mireshghallah and Binyi Chen and Hao Wang and Yulia Tsvetkov},
journal= {arXiv preprint arXiv:2309.17157},
year = {2024}
}