基于势函数的最优在线学习
机器学习
2022-12-08 v6
摘要
我们研究了一类用于在线学习的势函数。我们证明,若势函数的 1 至 4 阶导数均严格为正,则对手的极小极大最优策略为布朗运动。利用该事实,我们分析不同的势函数,并证明 Normal-Hedge 势为前 ε-百分位累计遗憾提供了最紧的上界。
引用
@article{arxiv.2106.10717,
title = {Optimal Online Learning using Potential Functions},
author = {Yoav Freund},
journal= {arXiv preprint arXiv:2106.10717},
year = {2022}
}