中文

必须学得快:强化学习中泛化的新基准

机器学习 2018-04-25 v2 机器学习

摘要

在本报告中,我们提出一个基于刺猬索尼克(Sonic the Hedgehog (TM))电子游戏系列的新的强化学习(reinforcement learning, RL)基准。该基准旨在衡量迁移学习和少样本学习算法在 RL 领域的性能。我们还提出并评估了该新基准上的一些基线算法。

关键词

引用

@article{arxiv.1804.03720,
  title  = {Gotta Learn Fast: A New Benchmark for Generalization in RL},
  author = {Alex Nichol and Vicki Pfau and Christopher Hesse and Oleg Klimov and John Schulman},
  journal= {arXiv preprint arXiv:1804.03720},
  year   = {2018}
}