中文

赢留输换作为重复囚徒困境中自确认均衡

种群与进化 2021-07-01 v2

摘要

演化博弈论假设参与者通过遗传继承高分参与者的策略。然而,当学习以文化方式发生时,往往难以仅凭观察行为识别某人的策略。本工作中,我们考虑重复囚徒困境中具有记忆一阶随机策略的参与者,并假设他们无法直接获知彼此策略,仅能观察一定轮数内的实际动作。基于观察,观察者须以贝叶斯方式推断常驻策略,并相应选择自身策略。通过考察最优响应关系,我们论证:在合作成本较低且观察性学习带来足够大不确定性的条件下,参与者能以自确认方式从完全背叛逃脱,进入由赢留输换(Win-Stay-Lose-Shift)支撑的合作均衡。

关键词

引用

@article{arxiv.2101.03489,
  title  = {Win-Stay-Lose-Shift as a self-confirming equilibrium in the iterated Prisoner's Dilemma},
  author = {Minjae Kim and Jung-Kyoo Choi and Seung Ki Baek},
  journal= {arXiv preprint arXiv:2101.03489},
  year   = {2021}
}

备注

16 pages, 3 figures