中文

面向代码模型的隐蔽后门攻击

密码学与安全 2023-08-30 v2 软件工程

摘要

代码模型,如 CodeBERT 与 CodeT5,提供代码的通用表示,在支撑下游自动化软件工程任务中起着关键作用。最近,代码模型被揭示易受后门攻击。被后门攻击的代码模型在干净样本上表现正常,但在注入激活后门的触发器的样本上会输出预定义的恶意结果。现有针对代码模型的后门攻击使用不隐蔽且易检测的触发器。本文旨在研究代码模型在隐蔽后门攻击下的脆弱性。为此,我们提出 AFRAIDOOR(自适应后门的对抗特征,Adversarial Feature as Adaptive Backdoor)。AFRAIDOOR 利用对抗扰动向不同输入中注入自适应触发器,从而实现隐蔽性。我们在三个广泛采用的代码模型(CodeBERT、PLBART 与 CodeT5)与两个下游任务(代码摘要与方法名预测)上评估 AFRAIDOOR。我们发现 AFRAIDOOR 中约 85% 的自适应触发器在防御过程中绕过检测,相比之下,先前工作的触发器仅有不到 12% 绕过防御。当不应用防御方法时,AFRAIDOOR 与基线均近乎完美的攻击成功率。然而一旦应用防御,基线成功率骤降至 10.47% 与 12.06%,而 AFRAIDOOR 在两任务上的成功率分别为 77.05% 与 92.98%。我们的发现暴露了代码模型在隐蔽后门攻击下的安全弱点,并表明 SOTA 防御方法无法提供充分保护。我们呼吁更多研究投入以理解代码模型的安全威胁并开发更有效的对策。

关键词

引用

@article{arxiv.2301.02496,
  title  = {Stealthy Backdoor Attack for Code Models},
  author = {Zhou Yang and Bowen Xu and Jie M. Zhang and Hong Jin Kang and Jieke Shi and Junda He and David Lo},
  journal= {arXiv preprint arXiv:2301.02496},
  year   = {2023}
}

备注

18 pages, Under review of IEEE Transactions on Software Engineering