强化学习目标函数的通用视角
机器学习
2023-06-06 v1
摘要
在本讲座中,我们提出一种关于强化学习(RL)目标函数的通用视角,展示了三个版本的目标。第一个版本是 RL 文献中目标的标准定义。随后我们将标准定义扩展为-回报版本,其统一了目标的标准定义。最后,我们提出一个通用目标,统一了前两个版本。最后一个版本提供了理解 RL 目标的高层视角,展示了连接一些广泛使用的 RL 技术(例如 TD 和 GAE)的基础公式,且该目标有潜力应用于广泛的 RL 算法。
引用
@article{arxiv.2306.03074,
title = {A General Perspective on Objectives of Reinforcement Learning},
author = {Long Yang},
journal= {arXiv preprint arXiv:2306.03074},
year = {2023}
}