中文

控制辅导的强化学习:在驱赶问题中的应用

机器学习 2019-11-28 v2 人工智能

摘要

在这篇扩展摘要中,我们介绍了一种新颖的控制辅导 Q 学习方法(CTQL),作为开发面向连续状态空间的基于模型且安全的 RL 的持续努力的一部分。我们通过将其应用于一个具有挑战性的多智能体驱赶控制问题来验证我们的方法。

关键词

引用

@article{arxiv.1911.11444,
  title  = {Control-Tutored Reinforcement Learning: an application to the Herding Problem},
  author = {Francesco De Lellis and Fabrizia Auletta and Giovanni Russo and Mario di Bernardo},
  journal= {arXiv preprint arXiv:1911.11444},
  year   = {2019}
}