中文

重复囚徒困境博弈中观测误差下强制线性收益关系的策略

种群与进化 2019-06-20 v2 物理与社会

摘要

重复博弈理论分析博弈参与者的长期关系,并从数学上揭示合作得以实现的条件,而这在一次性博弈中无法实现。在无误差的重复囚徒困境(RPD)博弈中,零行列式(ZD)策略允许参与者单方面设定其自身收益与对手收益之间的线性关系,而不论对手采用何种策略。相比之下,ALLD 与 ALLC 等无条件策略也同样单方面设定线性收益关系。在现实世界中,参与者之间经常发生误差。然而,关于在带误差的 RPD 博弈中此类策略的存在性所知甚少。在此,我们解析地搜索在 RPD 博弈中观测误差下强制线性收益关系的所有策略。结果我们发现,即使在存在观测误差的情形下,强制线性收益关系的策略集仅为 ZD 策略或无条件策略,且不存在其他策略能够强制该关系,这一点已通过数值模拟得到确认。

关键词

引用

@article{arxiv.1904.01208,
  title  = {Strategies that enforce linear payoff relationships under observation errors in Repeated Prisoner's Dilemma game},
  author = {Azumi Mamiya and Genki Ichinose},
  journal= {arXiv preprint arXiv:1904.01208},
  year   = {2019}
}

备注

19 pages, 3 figures