有限时间 4-专家预测问题
概率论
2019-12-04 v2 计算机科学与博弈论
机器学习
偏微分方程分析
机器学习
摘要
我们显式求解了在有限时域设定下含 个专家的专家预测问题动态规划的连续极限所对应的非线性 PDE。专家预测问题被表述为玩家与对手之间的零和博弈。通过证明解为 ,我们能够表明 arXiv:1409.3040G 中猜想的策略构成渐近纳什均衡。我们还证明了 arXiv:1409.3040G 中针对 提出的“有限 vs 几何遗憾”猜想,并说明该猜想实际上源于梳状策略最优的猜想。
引用
@article{arxiv.1911.10936,
title = {Finite-Time 4-Expert Prediction Problem},
author = {Erhan Bayraktar and Ibrahim Ekren and Xin Zhang},
journal= {arXiv preprint arXiv:1911.10936},
year = {2019}
}
备注
Keywords: machine learning, expert advice framework, asymptotic expansion, inverse Laplace transform, regret minimization, Jacobi-theta function