中文

强化学习目标函数的通用视角

机器学习 2023-06-06 v1

摘要

在本讲座中,我们提出一种关于强化学习(RL)目标函数的通用视角,展示了三个版本的目标。第一个版本是 RL 文献中目标的标准定义。随后我们将标准定义扩展为λ\lambda-回报版本,其统一了目标的标准定义。最后,我们提出一个通用目标,统一了前两个版本。最后一个版本提供了理解 RL 目标的高层视角,展示了连接一些广泛使用的 RL 技术(例如 TD(λ)(\lambda) 和 GAE)的基础公式,且该目标有潜力应用于广泛的 RL 算法。

关键词

引用

@article{arxiv.2306.03074,
  title  = {A General Perspective on Objectives of Reinforcement Learning},
  author = {Long Yang},
  journal= {arXiv preprint arXiv:2306.03074},
  year   = {2023}
}