中文

PenTest2.0:面向自主权限提升的生成式 AI

密码学与安全 2025-07-10 v1

摘要

当今的伦理渗透测试依赖于高技能的实践者执行复杂命令序列,这在本质上耗时、难以扩展且容易出错。为缓解这些限制,我们之前引入了 'PenTest++',一种结合自动化与生成式 AI 支持伦理渗透测试工作流程的人工智能增强系统。然而,PenTest++ 的关键局限性在于缺乏对权限提升的支持,这是伦理渗透测试的关键环节。本文提出了 'PenTest2.0',这是 PenTest++ 的一次重大演进,支持由大型语言模型驱动的自动化权限提升。它还包含若干重要增强功能:'检索增强生成'(包含单行模式和离线模式);'链式思考' 提示用于中间推理;持久的 'PenTest 任务树' 用于跨轮次跟踪目标进度;以及可选的人类作者提示集成。我们描述了其运作方式,呈现了原型原型,并讨论了其优势与局限性。我们还描述了将系统应用于受控 Linux 目标的情况,表明它能够完成多轮、自适应的权限提升。我们解释了其核心设计选择的依据,并提供了全面的测试结果和成本分析。我们的发现表明,'PenTest2.0' 表示了向实用、可扩展的人工智能自动化渗透测试迈出的重要一步,同时突显了生成式 AI 系统的局限性,特别是其对提示结构、执行上下文和语义漂移的敏感性,这强化了在这一新兴领域需要进一步研究和完善的必要性。

关键词

引用

@article{arxiv.2507.06742,
  title  = {PenTest2.0: Towards Autonomous Privilege Escalation Using GenAI},
  author = {Haitham S. Al-Sinani and Chris J. Mitchell},
  journal= {arXiv preprint arXiv:2507.06742},
  year   = {2025}
}

备注

45 pages, 23 figures