早起的鸟儿有虫吃:揭示LLM服务系统中的时序侧信道
密码学与安全
2025-10-22 v5
摘要
大型语言模型(LLM)的广泛部署催生了优化其推理性能的强烈需求。当今服务于这一目的的技术主要通过算法和硬件增强来减少延迟和提高吞吐量,而很大程度上忽视了其隐私副作用,特别是在多用户环境中。在我们的研究中,我们首次发现了LLM系统中的一组新的时序侧信道,这些侧信道源于共享缓存和GPU内存分配,可被利用来推断机密系统提示和其他用户发出的提示。这些漏洞呼应了传统计算系统中观察到的安全挑战,凸显了解决LLM服务基础设施中潜在信息泄露的紧迫性。在本文中,我们报告了旨在利用LLM部署中固有的此类时序侧信道的新型攻击策略,特别针对广泛用于增强LLM推理性能的键值(KV)缓存和语义缓存。我们的方法利用时序测量和分类模型来检测缓存命中,使攻击者能够高精度地推断私有提示。我们还提出了一种逐令牌搜索算法,以有效恢复缓存中的共享提示前缀,展示了窃取系统提示和同行用户产生的提示的可行性。我们对流行在线LLM服务的黑盒测试实验研究表明,这种隐私风险是完全现实的,且后果严重。我们的发现强调了需要采取稳健的缓解措施来保护LLM系统免受此类新兴威胁。
引用
@article{arxiv.2409.20002,
title = {The Early Bird Catches the Leak: Unveiling Timing Side Channels in LLM Serving Systems},
author = {Linke Song and Zixuan Pang and Wenhao Wang and Zihao Wang and XiaoFeng Wang and Hongbo Chen and Wei Song and Yier Jin and Dan Meng and Rui Hou},
journal= {arXiv preprint arXiv:2409.20002},
year = {2025}
}
备注
This work was first submitted for review on Sept. 5, 2024, and the initial version was uploaded to Arxiv on Sept. 30, 2024. The latest version has accepted for publication by IEEE Transactions on Information Forensics and Security (TIFS)