中文

安全是非可组合的:面向能力导向AI系统的形式化框架

人工智能 2026-03-20 v2

摘要

本文给出了安全在存在联合能力依赖时的非可组合性首个形式证明:两个代理人各自都无法达到任何禁止的能力,但当组合在一起时,通过涌现的联合依赖,两个代理人可以集体达到禁止的目标。

关键词

引用

@article{arxiv.2603.15973,
  title  = {Safety is Non-Compositional: A Formal Framework for Capability-Based AI Systems},
  author = {Cosimo Spera},
  journal= {arXiv preprint arXiv:2603.15973},
  year   = {2026}
}