中文

重复囚徒困境中的反应式均值

物理与社会 2023-02-28 v1

摘要

重复囚徒困境(IPD)是理解成对互动中直接互惠与合作的被广泛研究的框架。然而,对各种IPD策略的道德性度量仍大为缺乏。此处我们部分解决该问题,提出一套合理的道德性度量以量化正义的四个方面。由于反应式策略具有数学可处理性与表达力,我们将闭式计算聚焦于该类策略。我们定义反应式均值作为一种工具,用于研究IPD与重复雪堆博弈(ISG)中的行动者在典型情形下的行为。我们计算了旨在捕捉人类关于“善”与“公平博弈”直觉的四个函数的反应式均值。其中两个函数与IPD和ISG中的成功呈强负相关,另两个与成功呈弱负相关。我们的结果将有助于基于机器学习算法、使用简单直观的道德性度量来评价与比较强大的IPD策略。

关键词

引用

@article{arxiv.2302.13909,
  title  = {Reactive means in the Iterated Prisoner's Dilemma},
  author = {Grant Molnar and Caroline Hammond and Feng Fu},
  journal= {arXiv preprint arXiv:2302.13909},
  year   = {2023}
}

备注

18 pages, 3 figures