中文

基于有限差分的最优停止平均场博弈虚拟博弈

数值分析 2023-10-10 v1 数值分析

摘要

本文研究具有最优停止时间的平均场博弈(OSMFGs),其中智能体做出最优退出决策;与经典平均场博弈相比,此类模型中耦合的障碍方程与 Fokker-Planck 方程带来了挑战。本文提出一种广义虚拟博弈算法,通过迭代求解纯策略系统来计算 OSMFG 的混合均衡,即依据某种更新规则对纯策略取平均来近似混合策略。该广义虚拟博弈允许一类广泛的学习率,并且可以严格证明其对混合策略均衡的收敛性。该算法还结合了纯策略系统的高效有限差分格式,数值实验表明所提方法在鲁棒且高效地计算 OSMFG 混合均衡方面是有效的。

关键词

引用

@article{arxiv.2310.05741,
  title  = {Fictitious Play via Finite Differences for Mean Field Games with Optimal Stopping},
  author = {Chengfeng Shen and Yifan Luo and Zhennan Zhou},
  journal= {arXiv preprint arXiv:2310.05741},
  year   = {2023}
}