中文

随机博弈中对(基于 AI 的)未验证控制器进行沙箱隔离:一种基于抽象的安全监护架构方法

系统与控制 2022-03-29 v1 系统与控制

摘要

本文中,我们针对双人非合作随机博弈中未验证控制器(例如基于人工智能(即 AI-based)的控制器)的沙箱隔离,提出了一种安全监护(Safe-visor)架构的构建方案。具体地,我们利用基于抽象的方法构建一个监督器,用于检查并决定是否接受未验证控制器提供的输入,以及构建一个安全顾问,在未验证控制器被拒绝时提供兜底控制输入以确保安全。此外,通过利用原始博弈与其有限抽象之间的 (ϵ,δ\epsilon,\delta)-近似概率关系,我们针对由确定性有限自动机(DFA)建模的安全规范提供了形式化安全保证,同时仍利用了未验证控制器的功能性。为展示所提结果的有效性,我们将其应用于四旋翼跟踪移动地面车辆的控制问题,其中采用基于 AI 的未验证控制器来控制四旋翼。

关键词

引用

@article{arxiv.2203.14924,
  title  = {Sandboxing (AI-based) Unverified Controllers in Stochastic Games: An Abstraction-based Approach with Safe-visor Architecture},
  author = {Bingzhuo Zhong and Hongpeng Cao and Majid Zamani and Marco Caccamo},
  journal= {arXiv preprint arXiv:2203.14924},
  year   = {2022}
}