重复囚徒困境的不可战胜策略
计算机科学与博弈论
2017-12-19 v1
摘要
重复囚徒困境(IPD)是研究理性主体长期行为的一个著名基准,例如自私且无关联的个体如何在长期共存中涌现出合作。许多知名策略已被研究,从 Axelrod 在其颇具影响力的竞赛后声名鹊起的简单以牙还牙(TFT)策略,到近期 Press 和 Dyson 研究的零行列式等更复杂策略。本文沿用 Press 和 Dyson 的思路,考虑单记忆概率策略。我们考察了所谓不可战胜策略:若极限存在,一个策略若在平均收益意义上对任何其他策略在极限下从不落败,则称其为不可战胜的。我们证明了一个策略在无限重复囚徒困境中是不可战胜的。
引用
@article{arxiv.1712.06488,
title = {Invincible Strategies of Iterated Prisoner's Dilemma},
author = {Shiheng Wang and Fangzhen Lin},
journal= {arXiv preprint arXiv:1712.06488},
year = {2017}
}
备注
8 pages, 3 figures