有限次迭代囚徒困境中的合作均衡
适应与自组织系统
2007-05-23 v1 统计力学
摘要
Nash 均衡使用不相关行为或混合联合概率分布定义,实际上假设有限理性的参与者必须丢弃信息以定位均衡。我们则提出,理性的参与者将使用相关分布中可用的所有信息来约束收益函数拓扑和梯度,以生成新的“约束”均衡,每个均衡都是一条在约束空间中优化收益的逆向归纳路径。在有限次迭代囚徒困境中,我们定位了通过合作最大化收益的约束均衡,它附加于通过背叛最大化收益的无约束 (Nash) 均衡。我们的方法澄清了逆向归纳中通常隐藏的假设。
引用
@article{arxiv.nlin/0404023,
title = {Cooperative equilibria in the finite iterated prisoner's dilemma},
author = {Kae Nemoto and Michael J Gagen},
journal= {arXiv preprint arXiv:nlin/0404023},
year = {2007}
}
备注
13 pages