中文

CoTDeceptor:针对 CoT 增强型 LLM 代码代理的对抗代码混淆

密码学与安全 2025-12-25 v1 多智能体系统

摘要

LLM 基于代码的代理(如 ChatGPT Codex)日益被部署用于代码审查和安全审计任务。尽管 CoT 增强型 LLM 漏洞检测器被认为能够提供对混淆恶意代码的改进鲁性,但我们发现其推理链和语义抽象过程存在可被利用的系统性弱点。这允许攻击者隐蔽地嵌入恶意逻辑,绕过代码审查,并在真实世界的软件供应链中传播后门组件。为调查此问题,我们提出 CoTDeceptor,即首个针对 CoT 增强型 LLM 检测器的对抗代码混淆框架。CoTDeceptor 自主构建演化的、难以逆向的多阶段混淆策略链,有效干扰 CoT 驱动的检测逻辑。我们获得了来自安全企业的恶意代码,实验结果表明,CoTDeceptor 对最先进的 LLMs 和漏洞检测代理实现稳定且可迁移的规避性能。CoTDeceptor 绕过了 14/15 个漏洞类别中的 14 个类别,而仅有 2 个类别被先前方法绕过。我们的发现凸显了真实世界软件供应链中的潜在风险,强调需要更健壮且可解释的 LLM 驱动的安全分析系统。

关键词

引用

@article{arxiv.2512.21250,
  title  = {CoTDeceptor:Adversarial Code Obfuscation Against CoT-Enhanced LLM Code Agents},
  author = {Haoyang Li and Mingjin Li and Jinxin Zuo and Siqi Li and Xiao Li and Hao Wu and Yueming Lu and Xiaochuan He},
  journal= {arXiv preprint arXiv:2512.21250},
  year   = {2025}
}