Rainbow:深度强化学习中多种改进的融合
人工智能
2017-10-09 v1 机器学习
摘要
深度强化学习社区对DQN算法做出了若干独立的改进。然而,这些扩展中哪些具有互补性并可有效结合尚不清楚。本文考察了DQN算法的六种扩展,并实证研究了它们的组合。我们的实验表明,该组合在Atari 2600基准测试上提供了最先进的性能,无论是在数据效率还是最终性能方面。我们还提供了详细消融实验的结果,显示了每个组件对整体性能的贡献。
引用
@article{arxiv.1710.02298,
title = {Rainbow: Combining Improvements in Deep Reinforcement Learning},
author = {Matteo Hessel and Joseph Modayil and Hado van Hasselt and Tom Schaul and Georg Ostrovski and Will Dabney and Dan Horgan and Bilal Piot and Mohammad Azar and David Silver},
journal= {arXiv preprint arXiv:1710.02298},
year = {2017}
}
备注
Under review as a conference paper at AAAI 2018