一般和线性二次动态博弈中开环与反馈纳什均衡的分歧程度
系统与控制
2024-11-22 v3 系统与控制
摘要
动态博弈为模拟战略智能体不断演变的交互提供了一个通用框架,其稳态行为可以通过博弈的纳什均衡来捕捉。纳什均衡通常以反馈形式计算,其策略依赖于每个时刻的状态;或以开环形式计算,其策略仅依赖于初始状态。经验上,开环纳什均衡(OLNE)可能计算效率更高,而反馈纳什均衡(FBNE)通常编码了更复杂的交互。然而,目前尚不清楚究竟哪些动态博弈会产生显著不同的FBNE和OLNE,哪些则不会。为了解决这个问题,我们对线性二次(LQ)动态博弈中的OLNE和FBNE进行了原则性的比较研究。具体来说,我们证明了LQ动态博弈的OLNE策略可以通过求解一个具有扰动代价的辅助LQ博弈的耦合Riccati方程来合成。该辅助博弈的构建使我们能够建立OLNE和FBNE重合的条件,并推导出LQ博弈中FBNE与OLNE之间偏差的上界。
引用
@article{arxiv.2409.11257,
title = {To What Extent do Open-loop and Feedback Nash Equilibria Diverge in General-Sum Linear Quadratic Dynamic Games?},
author = {Chih-Yuan Chiu and Jingqi Li and Maulik Bhatt and Negar Mehr},
journal= {arXiv preprint arXiv:2409.11257},
year = {2024}
}