中文

具有多个正确答案的纯探索

机器学习 2019-02-12 v1 机器学习

摘要

我们确定了具有多个好答案的纯探索多臂老虎机问题的样本复杂度。我们使用一种新的博弈均衡论证推导出了下界。我们展示了单答案问题的连续性和凸性性质如何确保 Track-and-Stop 算法具有渐近最优的样本复杂度。然而,当转向多答案设定时,这种凸性便丧失了。我们提出了一种新算法,将 Track-and-Stop 扩展到多答案情形,并具有匹配下界的渐近样本复杂度。

关键词

引用

@article{arxiv.1902.03475,
  title  = {Pure Exploration with Multiple Correct Answers},
  author = {Rémy Degenne and Wouter M. Koolen},
  journal= {arXiv preprint arXiv:1902.03475},
  year   = {2019}
}