在并发 Büchi 与 co-Büchi 博弈中(近)最优地进行博弈
计算机科学与博弈论
2022-11-28 v2
摘要
我们研究有限图上的二人并发随机博弈,目标为 Büchi 与 co-Büchi 目标。第一位玩家的目标是最大化满足给定目标的概率。根据 Martin 关于 Blackwell 博弈的确定性定理,我们知道此类博弈具有值。自然的问题是:是否存在最优策略,即达到博弈值的策略?进行(近)最优博弈所需的内存是多少?在回合制博弈中情况较为简单,位置纯策略足以在带奇偶目标的博弈中最优博弈。并发性使情况变得复杂且异构。对于大多数 -正则目标,一般确实不存在最优策略。对于某些目标(我们将提及),进行最优或近最优博弈可能需要无限内存。我们还给出了玩家局部交互的刻画,以确保 Büchi 与 co-Büchi 目标下(近)最优策略的位置性。该刻画依赖于支撑两名玩家局部交互形式化的博弈形式的性质。这些良态博弈形式如同基本砖块,当它们在孤立状态下表现良好时,可在图博弈中组装并确保整个博弈的优良性质。
引用
@article{arxiv.2203.06966,
title = {Playing (Almost-)Optimally in Concurrent B\"uchi and co-B\"uchi Games},
author = {Benjamin Bordais and Patricia Bouyer and Stéphane Le Roux},
journal= {arXiv preprint arXiv:2203.06966},
year = {2022}
}