在自利人类存在下的安全控制再思考
人机交互
2023-02-13 v2 系统与控制
系统与控制
摘要
安全控制方法通常旨在即便在最坏情况下的人类不确定性中也保持安全行为。然而,人类可能利用此类安全优先系统,从而给所有人带来更大风险。尽管意义重大,此前并无工作在安全控制中研究并考量此类因素。本文利用博弈论中基于交互的收益结构来建模人类的短视、自利行为,以及人类如何基于既往经验改变其对机器的策略。我们将此类策略性人类行为整合进安全控制架构中。结果表明,与确定性的最坏情况安全控制技术以及基于均衡的随机方法相比,我们的方法实现了更好的安全性与性能权衡。我们的发现表明,为追求所有人的更高安全性,亟需从根本上重新思考人机交互中使用的安全控制框架。
引用
@article{arxiv.2212.00295,
title = {Rethinking Safe Control in the Presence of Self-Seeking Humans},
author = {Zixuan Zhang and Maitham AL-Sunni and Haoming Jing and Hirokazu Shirado and Yorie Nakahira},
journal= {arXiv preprint arXiv:2212.00295},
year = {2023}
}
备注
Accepted to the 37th AAAI Conference on Artificial Intelligence