渐近 Perron 方法与随机博弈及控制中的简单 Markov 策略
最优化与控制
2015-02-20 v4
摘要
我们引入了 Perron 方法的一种修正形式,其中半解是在精心定义的渐近意义下考虑的。利用这一定义,我们可以以一种相当初等的方式证明:在零和博弈或控制问题(无论是否存在模型不确定性)中,所有策略下的值函数与时间离散化的 Markov 策略下的值函数是一致的。因此,总是存在离散化的 Markov -最优策略(关于有界初始条件是一致的)。经过微调,该方法还能为反馈策略与反策略之间的非对称博弈生成值及近似鞍点。
引用
@article{arxiv.1402.7030,
title = {Asymptotic Perron's method and simple Markov Strategies in stochastic games and control},
author = {Mihai Sîrbu},
journal= {arXiv preprint arXiv:1402.7030},
year = {2015}
}
备注
some modifications and some typos fixed