具有多个正确答案的纯探索
机器学习
2019-02-12 v1 机器学习
摘要
我们确定了具有多个好答案的纯探索多臂老虎机问题的样本复杂度。我们使用一种新的博弈均衡论证推导出了下界。我们展示了单答案问题的连续性和凸性性质如何确保 Track-and-Stop 算法具有渐近最优的样本复杂度。然而,当转向多答案设定时,这种凸性便丧失了。我们提出了一种新算法,将 Track-and-Stop 扩展到多答案情形,并具有匹配下界的渐近样本复杂度。
引用
@article{arxiv.1902.03475,
title = {Pure Exploration with Multiple Correct Answers},
author = {Rémy Degenne and Wouter M. Koolen},
journal= {arXiv preprint arXiv:1902.03475},
year = {2019}
}