中文

重复博弈中观测误差下零行列式策略存在的条件

种群与进化 2021-06-29 v2

摘要

重复博弈是分析生物物种长期相互作用与复杂社会现象的有用模型。Press 与 Dyson 于 2012 年发现的重复博弈中的零行列式(ZD)策略强制焦点玩家与对手之间的线性收益关系。该线性关系可由 ZD 玩家任意设定。因此,ZD 策略的一个子类可固定对手的期望收益,另一子类可使其在期望收益上超过对手。自该发现以来,ZD 策略的理论被扩展以应对各种自然情形。尤其重要的是考虑带折扣因子与观测误差的重复博弈的 ZD 策略理论,因为这使该理论能应用于现实世界。近期研究揭示了即便在同时具备这两类因素的重复博弈中 ZD 策略也存在。然而,其存在条件尚未得到充分分析。在此,我们从数学上分析了同时具备这两类因素的重复博弈中的条件。首先,我们推导了确保 Equalizer 与正关联 ZD(pcZD)策略(众所周知的 ZD 策略子类)存在的折扣因子与观测误差的阈值。我们发现,随着错误率增大,ZD 策略仅当折扣因子保持较高时才存在。接着,我们推导了由 Equalizer 强制的对手期望收益的条件,以及由 pcZD 强制的线性直线斜率与基线收益的条件。结果表明,随着错误率增大或折扣因子减小,Equalizer 或 pcZD 所能强制的线性直线的条件变得严苛。

关键词

引用

@article{arxiv.2105.03951,
  title  = {Conditions for the existence of zero-determinant strategies under observation errors in repeated games},
  author = {Azumi Mamiya and Daiki Miyagawa and Genki Ichinose},
  journal= {arXiv preprint arXiv:2105.03951},
  year   = {2021}
}

备注

25 pages, 4 figures