中文

结合深度强化学习与局部控制用于 Acrobot 起摆与平衡任务

机器人学 2020-12-23 v1

摘要

在本工作中,我们提出了一种对软 actor-critic(当前最先进的深度强化学习算法)的新颖扩展。我们的方法允许我们将传统控制器与学习得到的神经网络策略相结合。这种组合使我们能够同时利用自身的领域知识以及无模型强化学习的一些优势。我们通过将手工设计的线性二次调节器与针对 acrobot 问题学习得到的控制器相结合来演示我们的算法。我们表明,在该设定下,我们的技术优于其他最先进的强化学习算法。

关键词

引用

@article{arxiv.2012.11663,
  title  = {Combining Deep Reinforcement Learning And Local Control For The Acrobot Swing-up And Balance Task},
  author = {Sean Gillen and Marco Molnar and Katie Byl},
  journal= {arXiv preprint arXiv:2012.11663},
  year   = {2020}
}

备注

Accepted to CDC 2020