价值函数近似中的伪复述
人工智能
2017-03-22 v1
摘要
灾难性遗忘在强化学习中尤为重要,因为数据分布通常随时间非平稳。我们研究并比较了在杆平衡任务中,用于带函数近似的Q学习的几种伪复述方法。我们发现,给定复述参数的适当初始化,伪复述似乎即使在如此简单的问题中也能辅助学习。
引用
@article{arxiv.1703.07075,
title = {Pseudorehearsal in value function approximation},
author = {Vladimir Marochko and Leonard Johard and Manuel Mazzara},
journal= {arXiv preprint arXiv:1703.07075},
year = {2017}
}