大群体中的虚拟博弈学习
计算机科学与博弈论
2019-01-11 v1
摘要
我们考虑大群智能体参与对称博弈的单次双人回合时的虚拟博弈学习,并推导相应随机过程的均值场型模型。利用该模型,我们描述了学习过程的定性性质并讨论其渐近行为。特别关注带与不带记忆因子的虚拟博弈学习的比较特征。作为分析的一部分,我们表明当所有智能体具有相似的经验概率时,该模型导出 Gilboa 与 Matsui (1991) 的连续最佳响应动力学方程。
引用
@article{arxiv.1901.02907,
title = {Learning by Fictitious Play in Large Populations},
author = {Misha Perepelitsa},
journal= {arXiv preprint arXiv:1901.02907},
year = {2019}
}
备注
16 pages, 2 figures