结合 A* 与深度启发式的强化学习
机器学习
2018-11-20 v1 机器学习
摘要
A* 是一种流行的寻路算法,但只能应用于那些已知良好启发式函数的领域。受近期结合深度神经网络(DNN)与树的方法启发,本研究展示了如何训练由 DNN 表示的启发式函数并将其与 A* 结合。这一我们称之为 aleph-star 的新算法可高效用于启发式输入能被神经网络处理的领域。我们在基于像素输入的驾驶仿真中将 aleph-star 与 N-Step Deep Q-Learning(DQN Mnih et al. 2013)进行比较,并展示了在该场景下显著更优的性能。
引用
@article{arxiv.1811.07745,
title = {Reinforcement Learning with A* and a Deep Heuristic},
author = {Ariel Keselman and Sergey Ten and Adham Ghazali and Majed Jubeh},
journal= {arXiv preprint arXiv:1811.07745},
year = {2018}
}
备注
6 pages 2 figures