中文

从AI生成内容到智能体行动:生成式AI中的安全与安全威胁

密码学与安全 2026-05-19 v1

摘要

生成式AI系统越来越多地用于不仅产生内容,还用于检索数据、调用工具和执行操作。本工作跨内容层面、模型层面和智能体威胁三个维度,考察了这一变化所带来的安全与安全影响。我们分析了随着模型从生成制品转移到通过工具链和外部API执行操作后,攻击者访问要求、系统自主性和潜在伤害范围如何变化。随后,我们评估了包括检测、水印、对齐和新兴智能体安全措施在内的技术对策,显示出其中几项依赖于当前治理安排尚未提供的制度性协调形式。我们所检视的案例表明,随着系统从生成内容转向执行现实世界操作,能力部署和攻击面扩展的速度持续超过防御性响应的速度。

关键词

引用

@article{arxiv.2605.16471,
  title  = {From AI-Generated Content to Agentic Action: Security and Safety Threats in Generative AI},
  author = {Zelin Zhang and Qi Li and Jie Cao and Lingshuang Liu and Jianbing Ni},
  journal= {arXiv preprint arXiv:2605.16471},
  year   = {2026}
}

备注

Accepted by Journal of Information and Intelligence (JII)