中文

结合 A* 与深度启发式的强化学习

机器学习 2018-11-20 v1 机器学习

摘要

A* 是一种流行的寻路算法,但只能应用于那些已知良好启发式函数的领域。受近期结合深度神经网络(DNN)与树的方法启发,本研究展示了如何训练由 DNN 表示的启发式函数并将其与 A* 结合。这一我们称之为 aleph-star 的新算法可高效用于启发式输入能被神经网络处理的领域。我们在基于像素输入的驾驶仿真中将 aleph-star 与 N-Step Deep Q-Learning(DQN Mnih et al. 2013)进行比较,并展示了在该场景下显著更优的性能。

关键词

引用

@article{arxiv.1811.07745,
  title  = {Reinforcement Learning with A* and a Deep Heuristic},
  author = {Ariel Keselman and Sergey Ten and Adham Ghazali and Majed Jubeh},
  journal= {arXiv preprint arXiv:1811.07745},
  year   = {2018}
}

备注

6 pages 2 figures