中文

在多人折扣和博弈中充分利用有限记忆

计算机科学与博弈论 2015-09-25 v3

摘要

本文确立了多人折扣和博弈中存在最优有界记忆策略组合。我们引入了一种非确定性方法来计算具有有界记忆的最优策略组合。该方法可用于在一种设定中获得最优奖励,其中一名强势玩家为所有玩家选择策略以实现纳什均衡和领导者均衡;在领导者均衡中,该强势玩家的策略可豁免纳什条件。由此产生的策略组合在该玩家尊重给定记忆界限的所有策略组合中是最优的,且相关的判定问题是 NP 完全的。我们还提供了简单示例,表明拥有更多记忆将改善最优策略组合,且获得最优策略组合所需的充分记忆量无法从博弈结构中推断出来。

关键词

引用

@article{arxiv.1410.4154,
  title  = {Making the Best of Limited Memory in Multi-Player Discounted Sum Games},
  author = {Anshul Gupta and Sven Schewe and Dominik Wojtczak},
  journal= {arXiv preprint arXiv:1410.4154},
  year   = {2015}
}

备注

In Proceedings GandALF 2015, arXiv:1509.06858