不完美信息博弈中的有限前瞻
计算机科学与博弈论
2020-03-20 v2 人工智能
多智能体系统
摘要
有限前瞻在完美信息博弈中已被研究数十年。我们通过两个同时的偏离点开启新方向:推广到不完美信息博弈,以及采用博弈论方法。我们研究当面对前瞻受限的对手时该如何行动。我们针对基于前瞻深度不同、是否同样具有不完美信息、以及如何处理平局而不同的对手进行研究。我们刻画了为任一方寻找纳什均衡或最优承诺策略的困难性,表明在某些变体中该问题可在多项式时间内求解,而在其他变体中则是 PPAD-hard、NP-hard 或不可近似的。接着我们设计算法来计算最优承诺策略——适用于对手按有利方式、按固定规则或对抗性地打破平局的情形。然后我们通过实验研究有限前瞻的影响。若有限前瞻方知道博弈树中某些均衡下节点的期望值,其通常可获得博弈值——但我们证明这一般而言并不充分。最后,我们研究了这些估计中的噪声以及不同前瞻深度的影响。
引用
@article{arxiv.1902.06335,
title = {Limited Lookahead in Imperfect-Information Games},
author = {Christian Kroer and Tuomas Sandholm},
journal= {arXiv preprint arXiv:1902.06335},
year = {2020}
}