并发随机可达博弈上值迭代与策略迭代的停止准则
计算机科学与博弈论
2019-09-19 v1 形式语言与自动机理论
摘要
我们考虑图上具有可达性与安全性目标的并发随机博弈。这些博弈可通过值迭代以及策略迭代求解,二者各自产生可达性值的下近似序列与安全性值的上近似序列,并在极限处收敛于真实值。对于两种方法,我们均提供了首个带停止准则的(任意时刻)算法。值迭代的停止准则基于提供收敛的上近似序列,从而可估计与真实值的距离。对于策略迭代,我们通过为可达性补充一种新的下近似安全性值的策略迭代算法来界定误差。
引用
@article{arxiv.1909.08348,
title = {Stopping Criteria for Value and Strategy Iteration on Concurrent Stochastic Reachability Games},
author = {Julia Eisentraut and Jan Křetínský and Alexej Rotar},
journal= {arXiv preprint arXiv:1909.08348},
year = {2019}
}