中文

LLM 仓库中脆弱包依赖的实证研究

密码学与安全 2025-09-01 v1 软件工程

摘要

大语言模型 (LLMs) 近年来发展迅猛,正在革新多个领域。尽管其取得了广泛成功,但 LLMs 严重依赖来自包管理系统的外部代码依赖,形成了复杂且互相交织的 LLM 依赖供应链。依赖项中的漏洞会暴露 LLMs 于安全风险。虽然现有研究主要关注模型层面的安全威胁,但 LLM 依赖供应链中的漏洞被忽视了。为填补这一空白,我们对 52 个开源 LLMs 进行了实证分析,检查其第三方依赖及其相关漏洞。随后,我们探索了 LLM 仓库中的活动,以了解维护者在实践中如何管理第三方漏洞。最后,我们将 LLM 生态系统中的第三方依赖漏洞与 Python 生态系统进行比较。我们的结果表明,LLM 生态系统中的半数漏洞在超过 56.2 个月后才被披露,显著长于 Python 生态系统。此外,75.8% 的 LLMs 包含其配置文件中含有脆弱依赖。这项研究深化了对 LLM 供应链风险的理解,为实践者提供了见解,并指出了改善 LLM 供应链安全的潜在方向。

关键词

引用

@article{arxiv.2508.21417,
  title  = {An Empirical Study of Vulnerable Package Dependencies in LLM Repositories},
  author = {Shuhan Liu and Xing Hu and Xin Xia and David Lo and Xiaohu Yang},
  journal= {arXiv preprint arXiv:2508.21417},
  year   = {2025}
}