不完美信息的广义形式中的虚假博弈
计算机科学与博弈论
2025-04-28 v1 最优化与控制
摘要
我们研究了在具有完美回忆的不完美信息的重复广义形式博弈中虚假博弈过程的长期行为。每个玩家保持关于除玩家将要做出动作的信息集合之外所有信息集合上动作是否根据固定随机策略进行的错误信念。因此,每个玩家在其任何信息集合上的动作都是为了最大化其在假设其他信息集合上的动作根据过去动作的经验频率进行时所做出的动作。我们扩展了已知的Monderer-Shapley结果 [1],关于经验频率收敛于Nash均衡集合的证明,以适用于具有相同利益的某些类广义形式博弈。随后,我们通过使用惯性和淡化记忆来强化该结果,并证明在所有具有相同利益的不完美信息的广义形式博弈中,实现的玩法路径收敛于一种本质纯Nash均衡。
引用
@article{arxiv.2504.18075,
title = {Fictitious Play in Extensive-Form Games of Imperfect Information},
author = {Jason Castiglione and Gürdal Arslan},
journal= {arXiv preprint arXiv:2504.18075},
year = {2025}
}