采样虚拟博弈具有Hannan一致性
计算机科学与博弈论
2017-04-12 v2 机器学习
机器学习
摘要
虚拟博弈是一种简单且被广泛研究的用于进行重复博弈的自适应启发式方法。众所周知,虚拟博弈不具备Hannan一致性。虚拟博弈的几种变体,包括遗憾匹配、广义遗憾匹配和平滑虚拟博弈,已被证明具有Hannan一致性。在这篇短文中,我们考虑采样虚拟博弈:在每一轮,玩家采样过去的时间点,并对其他玩家在这些采样时间点上的先前动作做出最佳响应。我们证明,使用伯努利采样的采样虚拟博弈具有Hannan一致性。与许多依赖测度集中结果的现有Hannan一致性证明不同,我们的证明转而使用来自Littlewood-Offord理论的反集中结果。
引用
@article{arxiv.1610.01687,
title = {Sampled Fictitious Play is Hannan Consistent},
author = {Zifan Li and Ambuj Tewari},
journal= {arXiv preprint arXiv:1610.01687},
year = {2017}
}