面向 Byzantine 对手的分布式 AI 治理攻击与缓解措施
密码学与安全
2026-05-13 v1 机器学习
多智能体系统
摘要
Agentic AI 治理是 agentic AI 基础设施的关键组成部分,确保代理人遵循其所有者的通信和交互政策,并提供针对恶意代理人的防护。当前最佳方案 SAGA 假设存在一个逻辑上集中化的信任点——服务提供商——其作为用户和代理信息的存储库,并积极执行政策。虽然 SAGA 提供了针对恶意代理的防护,但其仍然 vulnerable to 来自恶意服务提供商的攻击,这会破坏身份和访问控制基础设施的安全性。部署在私有云和公共云上,各自都可能遭受内部威胁,进一步增加了服务提供商被窃取的风险。本文分析了可从被窃取的服务提供商发起的攻击,考虑到不同的系统组件和现实部署。我们识别并执行了几个具有毁灭性影响的具体攻击:破坏代理可归属性、提取私人数据或绕过访问控制。我们随后提出了三种保障服务提供商的解决方案,提供不同的安全性与性能之间的权衡。我们首先提出 SAGA-BFT,一个完全抗 Byzantine 架构,提供最强的防护,但因 Byzantine 韧协议的高成本而造成显著的性能降级。我们随后提出 SAGA-MON 和 SAGA-AUD,两个新方案利用轻型服务器端监控或客户端审计,以在最小开销下提供针对大多数攻击类的防护。最后,我们提出 SAGA-HYB,一种混合架构,将 Byzantine 韧性与监控和审计相结合,以在安全性和性能之间进行权衡。我们评估了所有架构并与 SAGA 进行比较。我们讨论了哪种方案最合适以及在何种条件下使用。
引用
@article{arxiv.2605.12364,
title = {Attacks and Mitigations for Distributed Governance of Agentic AI under Byzantine Adversaries},
author = {Matthew D. Laws and Alina Oprea and Cristina Nita-Rotaru},
journal= {arXiv preprint arXiv:2605.12364},
year = {2026}
}
备注
18 pages, 18 figures, 4 tables