中文

多智能体系统安全运行时强制的在线综合

系统与控制 2020-03-02 v2 人工智能 多智能体系统 系统与控制

摘要

shield 附着于系统以通过在运行时修正系统行为来保证安全。现有采用设计时 shield 综合的方法无法扩展到多智能体系统。而且,此类 shield 通常以集中式实现,需要系统中所有智能体状态的全局信息。我们通过一种新方法来解决这些局限:shield 在运行时综合且不需要全局信息。每个智能体上载有一个 shield,其只能修改对应智能体的行为。在这种根本去中心化的方法中,每个智能体上的 shield 有两个组件:修正智能体行为的路径寻找器,以及动态修改智能体优先级的排序机制。当前优先级决定 shield 是否使用路径寻找器修改智能体行为。我们推导出任意智能体偏离其原始行为的最大偏差上界。我们证明最坏情况综合时间在运行时关于智能体数量为二次,而非现有方法在设计时的指数级。我们在避碰问题上测试了该去中心化运行时 shield 综合方法的性能。对于 50x50 网格中的 50 个智能体,运行时综合在检测到潜在碰撞时每个智能体仅需数秒。相比之下,类似设置下的集中式设计时 shield 综合在 5x5 网格中超过 4 个智能体便不可解。

关键词

引用

@article{arxiv.1910.10380,
  title  = {Online Synthesis for Runtime Enforcement of Safety in Multi-Agent Systems},
  author = {Dhananjay Raju and Suda Bharadwaj and Ufuk Topcu},
  journal= {arXiv preprint arXiv:1910.10380},
  year   = {2020}
}