赢留输换作为重复囚徒困境中自确认均衡
种群与进化
2021-07-01 v2
摘要
演化博弈论假设参与者通过遗传继承高分参与者的策略。然而,当学习以文化方式发生时,往往难以仅凭观察行为识别某人的策略。本工作中,我们考虑重复囚徒困境中具有记忆一阶随机策略的参与者,并假设他们无法直接获知彼此策略,仅能观察一定轮数内的实际动作。基于观察,观察者须以贝叶斯方式推断常驻策略,并相应选择自身策略。通过考察最优响应关系,我们论证:在合作成本较低且观察性学习带来足够大不确定性的条件下,参与者能以自确认方式从完全背叛逃脱,进入由赢留输换(Win-Stay-Lose-Shift)支撑的合作均衡。
引用
@article{arxiv.2101.03489,
title = {Win-Stay-Lose-Shift as a self-confirming equilibrium in the iterated Prisoner's Dilemma},
author = {Minjae Kim and Jung-Kyoo Choi and Seung Ki Baek},
journal= {arXiv preprint arXiv:2101.03489},
year = {2021}
}
备注
16 pages, 3 figures