中文

自主对抗者:LLM 时代的红队测试

密码学与安全 2026-05-08 v1

摘要

语言模型代理(LMA)正成为增强红队操作的强大原语。它们可支持攻击规划、对手模拟以及多步活动的编排(如横向移动,这是高级持续性威胁(APT)活动的核心支撑能力)。使用 MITRE ATT&CK 等框架,我们分析了这些代理与核心攻击功能的交汇点,并评估了 LMA 当前的优势与局限,重点关注治理与实际评估。我们在受控的对手模拟环境中对 LMA 进行了两种横向移动场景的基准测试。在此环境中,LMA 与插桩网络代理交互,观测执行工件,并基于环境反馈进行迭代适应。每个场景被形式化为具有明确验证谓词的有序任务链,利用 LLM-as-a-Judge 范式以确保确定性的结果验证。我们比较了三种操作模式:完全自主执行、自脚手架规划以及专家定义的行动方案。初步结果表明,相较于其他操作模式,专家定义的行动方案具有更高的任务完成率。然而,所有模式下的失败仍然频繁,这主要归因于脆弱的命令调用、环境与部署的不稳定性,以及凭据管理和状态处理中反复出现的错误。

关键词

引用

@article{arxiv.2605.06486,
  title  = {Autonomous Adversary: Red-Teaming in the age of LLM},
  author = {Mohammad Mamun and Mohamed Gaber and Scott Buffett and Sherif Saad},
  journal= {arXiv preprint arXiv:2605.06486},
  year   = {2026}
}

备注

Accepted at ACISP 2026