中文

Rainbow:深度强化学习中多种改进的融合

人工智能 2017-10-09 v1 机器学习

摘要

深度强化学习社区对DQN算法做出了若干独立的改进。然而,这些扩展中哪些具有互补性并可有效结合尚不清楚。本文考察了DQN算法的六种扩展,并实证研究了它们的组合。我们的实验表明,该组合在Atari 2600基准测试上提供了最先进的性能,无论是在数据效率还是最终性能方面。我们还提供了详细消融实验的结果,显示了每个组件对整体性能的贡献。

关键词

引用

@article{arxiv.1710.02298,
  title  = {Rainbow: Combining Improvements in Deep Reinforcement Learning},
  author = {Matteo Hessel and Joseph Modayil and Hado van Hasselt and Tom Schaul and Georg Ostrovski and Will Dabney and Dan Horgan and Bilal Piot and Mohammad Azar and David Silver},
  journal= {arXiv preprint arXiv:1710.02298},
  year   = {2017}
}

备注

Under review as a conference paper at AAAI 2018