中文

价值函数近似中的伪复述

人工智能 2017-03-22 v1

摘要

灾难性遗忘在强化学习中尤为重要,因为数据分布通常随时间非平稳。我们研究并比较了在杆平衡任务中,用于带函数近似的Q学习的几种伪复述方法。我们发现,给定复述参数的适当初始化,伪复述似乎即使在如此简单的问题中也能辅助学习。

关键词

引用

@article{arxiv.1703.07075,
  title  = {Pseudorehearsal in value function approximation},
  author = {Vladimir Marochko and Leonard Johard and Manuel Mazzara},
  journal= {arXiv preprint arXiv:1703.07075},
  year   = {2017}
}