中文

智能体AI的攻击与防御景观:综合综述

密码学与安全 2026-03-13 v1 人工智能

摘要

将大语言模型与非AI系统组件相结合的AI代理正在快速出现于实际应用中,提供了前所未有的自动化和灵活性。然而,这种前所未有的灵活性引入了与传统软件系统不同的复杂安全挑战。本文提出了AI代理安全的第一系统性和全面综述,包括对设计空间、攻击景观和安全AI代理系统防御机制的分析。我们进一步进行案例研究,指出现有AI代理系统安全性的空白,并确定在这一新兴领域的开放挑战。我们的工作还引入了一种用于理解AI代理安全风险和防御策略的第一系统框架,为构建安全的AI代理系统和推动该关键领域的研究提供了基础。

关键词

引用

@article{arxiv.2603.11088,
  title  = {The Attack and Defense Landscape of Agentic AI: A Comprehensive Survey},
  author = {Juhee Kim and Xiaoyuan Liu and Zhun Wang and Shi Qiu and Bo Li and Wenbo Guo and Dawn Song},
  journal= {arXiv preprint arXiv:2603.11088},
  year   = {2026}
}

备注

Accepted to USENIX Security 2026. This manuscript is an extended version of the conference paper, including additional discussion and updated content