中文

重复囚徒困境的不可战胜策略

计算机科学与博弈论 2017-12-19 v1

摘要

重复囚徒困境(IPD)是研究理性主体长期行为的一个著名基准,例如自私且无关联的个体如何在长期共存中涌现出合作。许多知名策略已被研究,从 Axelrod 在其颇具影响力的竞赛后声名鹊起的简单以牙还牙(TFT)策略,到近期 Press 和 Dyson 研究的零行列式等更复杂策略。本文沿用 Press 和 Dyson 的思路,考虑单记忆概率策略。我们考察了所谓不可战胜策略:若极限存在,一个策略若在平均收益意义上对任何其他策略在极限下从不落败,则称其为不可战胜的。我们证明了一个策略在无限重复囚徒困境中是不可战胜的。

关键词

引用

@article{arxiv.1712.06488,
  title  = {Invincible Strategies of Iterated Prisoner's Dilemma},
  author = {Shiheng Wang and Fangzhen Lin},
  journal= {arXiv preprint arXiv:1712.06488},
  year   = {2017}
}

备注

8 pages, 3 figures