利用心智理论寻找针对记忆一策略的最优响应
计算机科学与博弈论
2020-09-30 v3
摘要
记忆一策略是一组迭代囚徒困境策略,因其数学可处理性以及对抗单个对手时的性能而受到推崇。本手稿借助对其对手的心智理论,研究最优响应记忆一策略。结果补充了已有文献——后者已表明勒索式博弈并非总是最优的——通过证明最优博弈往往并非勒索式。它们还提供证据表明,在多智能体交互中记忆一策略受其有限记忆所累,并可能被具有更长记忆的优化策略超越。我们发展了一种理论,得以探索记忆一策略的整个空间。所提出的框架适用于研究囚徒困境中的记忆一策略,也适用于诸如Moran过程等进化过程。此外,还获得了关于记忆一策略种群中背叛行为稳定性的结果。
引用
@article{arxiv.1911.12112,
title = {Using a theory of mind to find best responses to memory-one strategies},
author = {Nikoleta E. Glynatsi and Vincent A. Knight},
journal= {arXiv preprint arXiv:1911.12112},
year = {2020}
}