论安全博弈中斯塔克伯格均衡的可诱导性
计算机科学与博弈论
2018-11-12 v1
摘要
强斯塔克伯格均衡(SSE)是斯塔克伯格安全博弈的标准解概念。与弱斯塔克伯格均衡(WSE)不同,SSE 假设跟随者在平局时偏向领导者,这一点被广泛认可,并由如下论断所佐证:防御者常可通过对其策略做无穷小调整来诱导攻击者选择偏好的行动。遗憾的是,在具有资源分配约束的安全博弈中,该论断可能不成立;防御者有可能无法诱导出期望结果。因此,文献中宣称的许多结果可能过于乐观。为弥补此缺陷,我们首先形式化定义防御者策略的效用保证,并给出示例表明 SSE 的效用可能高于其效用保证。其次,受 Von Stengel 与 Zamir(2004)对领导者收益的分析启发,我们提出称为可诱导斯塔克伯格均衡(ISE)的解概念,其拥有最高的效用保证且始终存在。第三,我们给出 ISE 与 SSE 重合的条件,以及一般情况下 SSE 在效用保证方面可能极差的事实。此外,引入 ISE 不会使现有算法结果失效,因为计算 ISE 的问题可多项式归约至计算 SSE 的问题。我们还提供了计算 ISE 的算法实现,实验由此揭示了 ISE 相对于 SSE 的经验优势。
引用
@article{arxiv.1811.03823,
title = {On the Inducibility of Stackelberg Equilibrium for Security Games},
author = {Qingyu Guo and Jiarui Gan and Fei Fang and Long Tran-Thanh and Milind Tambe and Bo An},
journal= {arXiv preprint arXiv:1811.03823},
year = {2018}
}
备注
The Thirty-Third AAAI Conference on Artificial Intelligence