基于轨迹学习的迷宫滚球游戏
机器学习
2018-12-18 v2 机器学习
摘要
深度强化学习在解决若干游戏与机器人任务中展现了巨大成功。然而,不同于人类,它通常需要大量训练样本。模仿解决当前任务的轨迹有助于提升深度 RL 方法的样本效率。本文中,我们提出一种利用此类轨迹的简单方法,应用于文献中近期提出的具有挑战性的迷宫滚球游戏。我们表明,尽管未使用人工生成轨迹,仅利用模拟器作为模型生成有限数量的轨迹,我们仍能在学习过程中获得约 2-3 倍的加速。我们也讨论了在使用基于轨迹学习处理极稀疏奖励函数时所观测到的一些挑战。
引用
@article{arxiv.1811.11441,
title = {Trajectory-based Learning for Ball-in-Maze Games},
author = {Sujoy Paul and Jeroen van Baar},
journal= {arXiv preprint arXiv:1811.11441},
year = {2018}
}
备注
Accepted at NIPS 2018 Workshop on Imitation Learning