安全是非可组合的:面向能力导向AI系统的形式化框架
人工智能
2026-03-20 v2
摘要
本文给出了安全在存在联合能力依赖时的非可组合性首个形式证明:两个代理人各自都无法达到任何禁止的能力,但当组合在一起时,通过涌现的联合依赖,两个代理人可以集体达到禁止的目标。
引用
@article{arxiv.2603.15973,
title = {Safety is Non-Compositional: A Formal Framework for Capability-Based AI Systems},
author = {Cosimo Spera},
journal= {arXiv preprint arXiv:2603.15973},
year = {2026}
}