从勒索到慷慨:囚徒困境中零行列式策略的演化
种群与进化
2013-12-30 v3 动力系统
摘要
最近的研究揭示了一类用于迭代双人博弈的新型“零行列式”(ZD) 策略。ZD 策略允许玩家单方面强制其得分与对手得分之间呈线性关系,从而对双方的长期收益实现异常程度的控制。虽然 ZD 策略最初是在经典双人博弈论的背景下提出的,但它们在玩家演化种群中也具有后果。在此,我们探讨迭代囚徒困境 (IPD) 中 ZD 策略的演化前景。几项最近的研究集中于“勒索策略”(零行列式策略的一个子集)的演化,并发现它们在种群中并不成功。然而,我们识别出另一类称为“慷慨 ZD 策略”的 ZD 策略子集,它们能宽恕背叛的对手,但在演化种群中仍占主导地位。除最小的种群规模外,慷慨 ZD 策略不仅稳健地抵抗被其他策略取代,还能选择性地取代任何非合作的 ZD 策略。慷慨策略可以推广到 ZD 策略空间之外,并且依然稳健地抵抗入侵。当演化发生在所有 IPD 策略的全集上时,选择过程不成比例地青睐这些慷慨策略。在某些机制下,慷慨策略的表现甚至优于最著名的迭代囚徒困境策略(包括“赢则留、输则移”策略)。
引用
@article{arxiv.1304.7205,
title = {From extortion to generosity, the evolution of zero-determinant strategies in the prisoner's dilemma},
author = {Alexander J. Stewart and Joshua B. Plotkin},
journal= {arXiv preprint arXiv:1304.7205},
year = {2013}
}