负学习率与P-Learning
人工智能
2018-06-19 v3 机器学习
摘要
我们提出一种使用负样本训练可微函数逼近器以完成回归任务的方法。我们利用负学习率实现该训练。我们还展示此方法如何用于在强化学习设定中执行直接策略学习。
引用
@article{arxiv.1603.08253,
title = {Negative Learning Rates and P-Learning},
author = {Devon Merrill},
journal= {arXiv preprint arXiv:1603.08253},
year = {2018}
}
备注
Embarrassingly poor manuscript with many errors