中文

囚徒困境博弈中共同进化学习中的信息参考不对称性导致的剥削

最优化与控制 2021-09-29 v1 适应与自组织系统 物理与社会

摘要

互惠关系,如合作与剥削,是人类及其他生物社会的基础。这些关系的基础植根于个体的决策,以及他们选择自私还是利他。个体如何选择其行为可以通过博弈论框架中的策略优化过程来分析。先前的研究表明,参考个体先前的行动在其策略选择和社会关系建立中起着重要作用。一个基本问题仍然存在:在策略选择的学习过程中,拥有更多信息的个体是否能够剥削拥有较少信息的个体?在这里,我们证明,使用记忆一策略(可以参照自身和对手的先前行动)的玩家,可以被仅拥有对手信息的反应型玩家基于相互自适应学习所剥削。这违反直觉,因为前者有更多的策略选择,并可能获得更高的收益。我们通过将策略选择的学习过程表述为耦合复制动力学以优化收益,并将其应用于囚徒困境博弈来证明这一点。进一步,我们表明,使用记忆一策略的玩家通过参考自身先前经验,有时会对对手的背叛表现得更加慷慨,从而接受对手的剥削。主要地,我们发现通过自适应学习,信息有限的玩家通常剥削信息更多的玩家,导致不对称剥削。

关键词

引用

@article{arxiv.2109.13799,
  title  = {Exploitation by asymmetry of information reference in coevolutionary learning in prisoner's dilemma game},
  author = {Yuma Fujimoto and Kunihiko Kaneko},
  journal= {arXiv preprint arXiv:2109.13799},
  year   = {2021}
}

备注

20pages, 6(mainmanuscript)+3(supplement)figures