平均场博弈的值迭代算法
系统与控制
2020-04-02 v3 系统与控制
最优化与控制
摘要
在文献中,对于离散时间平均场博弈,在折扣代价与平均代价最优性准则下均已建立平均场均衡的存在性。本文中,我们提供一种值迭代算法,用于计算此前已证明存在的折扣代价与平均代价准则下的平均场均衡。我们确立该值迭代算法收敛到平均场均衡算子的不动点。随后,利用该不动点,我们构造出一个平均场均衡。在我们的值迭代算法中,我们使用函数而非值函数。
引用
@article{arxiv.1909.01758,
title = {Value Iteration Algorithm for Mean-field Games},
author = {Berkay Anahtarci and Can Deha Kariksiz and Naci Saldi},
journal= {arXiv preprint arXiv:1909.01758},
year = {2020}
}
备注
23 pages