中文

自适应期望水平强化学习促进合作演化

种群与进化 2011-11-08 v2

摘要

个体间的重复互动是社会困境情境中维持合作的主要机制。以牙还牙(重复对手的先前行动)和赢留输变策略的变体在迭代社会困境博弈中被认为是强有力的竞争者。另一方面,真实的重复互动通常允许个体基于过去经验的可塑性(即学习)。尽管可塑性与各种生物现象相关,但其在重复社会困境博弈中的作用相对未被探索。特别是,如果基于经验的学习在促进和维持合作中起关键作用,那么学习者应在选择压力下在与非学习者的竞争中演化。通过使用一个简单的强化学习模型对玩家进行建模,我们数值地展示了学习能够实现合作的演化。我们还展示了数值估计的自适应动力学能够恰当地预测演化模拟的结果。对自适应动力学的分析使我们能够将所得结果理解为鲍德温效应的一个肯定性例子,其中学习加速了向最优性的演化。

关键词

引用

@article{arxiv.1106.6107,
  title  = {Evolution of cooperation facilitated by reinforcement learning with adaptive aspiration levels},
  author = {Shoma Tanabe and Naoki Masuda},
  journal= {arXiv preprint arXiv:1106.6107},
  year   = {2011}
}

备注

8 figures and 1 table