中文

多目标深度强化学习

人工智能 2016-10-11 v1

摘要

我们提出深度乐观线性支持学习(DOL)来解决高维多目标决策问题,其中各目标的相对重要性事先未知。DOL利用高维输入的特征,计算包含所有潜在最优解的凸覆盖集,这些解对应于目标的凸组合。据我们所知,这是深度强化学习首次成功学习多目标策略。此外,我们提供了一个包含两个实验的测试平台,用作深度多目标强化学习的基准。

关键词

引用

@article{arxiv.1610.02707,
  title  = {Multi-Objective Deep Reinforcement Learning},
  author = {Hossam Mossalam and Yannis M. Assael and Diederik M. Roijers and Shimon Whiteson},
  journal= {arXiv preprint arXiv:1610.02707},
  year   = {2016}
}