自主对抗者:LLM 时代的红队测试
密码学与安全
2026-05-08 v1
摘要
语言模型代理(LMA)正成为增强红队操作的强大原语。它们可支持攻击规划、对手模拟以及多步活动的编排(如横向移动,这是高级持续性威胁(APT)活动的核心支撑能力)。使用 MITRE ATT&CK 等框架,我们分析了这些代理与核心攻击功能的交汇点,并评估了 LMA 当前的优势与局限,重点关注治理与实际评估。我们在受控的对手模拟环境中对 LMA 进行了两种横向移动场景的基准测试。在此环境中,LMA 与插桩网络代理交互,观测执行工件,并基于环境反馈进行迭代适应。每个场景被形式化为具有明确验证谓词的有序任务链,利用 LLM-as-a-Judge 范式以确保确定性的结果验证。我们比较了三种操作模式:完全自主执行、自脚手架规划以及专家定义的行动方案。初步结果表明,相较于其他操作模式,专家定义的行动方案具有更高的任务完成率。然而,所有模式下的失败仍然频繁,这主要归因于脆弱的命令调用、环境与部署的不稳定性,以及凭据管理和状态处理中反复出现的错误。
关键词
引用
@article{arxiv.2605.06486,
title = {Autonomous Adversary: Red-Teaming in the age of LLM},
author = {Mohammad Mamun and Mohamed Gaber and Scott Buffett and Sherif Saad},
journal= {arXiv preprint arXiv:2605.06486},
year = {2026}
}
备注
Accepted at ACISP 2026