网格上蒙特卡洛规则囚徒困境博弈中的合作
计算机科学与博弈论
2019-04-16 v1 物理与社会
摘要
本文从经典蒙特卡洛方法的思想出发,在网格上研究带有蒙特卡洛规则的囚徒困境博弈。蒙特卡洛规则是当前个体策略调整动态规则的有序结合,不仅充分利用了信息,而且反映了个体的有限理性行为以及在追求高收益与高风险之间的矛盾心理。此外,它还反映了个体的行为执行偏好。蒙特卡洛规则的实施带来了极好的结果,与无条件模仿规则、复制动力学规则和费米规则相比,实现了更高的合作水平和更强的鲁棒性。当分析合作者平衡密度作为背叛诱惑的函数时,随着背叛诱惑的增强,合作者与背叛者共存混合态和背叛者纯态之间出现了平滑过渡,这可以用三角行为而非先驱工作中发现的幂律行为来完美刻画。当讨论背叛诱惑与合作者和背叛者平均收益的关系时,发现合作者的平均收益在整个诱惑参数范围内几乎为常数,而背叛者的平均收益随诱惑增大而下降。此外,还证明了合作水平对合作者初始密度的不敏感性以及对社群人口的敏感性。
引用
@article{arxiv.1904.06949,
title = {Cooperation on the monte carlo rule Prison's dilemma game on the grid},
author = {Jiadong Wu and Chengye Zhao},
journal= {arXiv preprint arXiv:1904.06949},
year = {2019}
}