面向连续状态空间环境的强化学习智能体研究
人工智能
2019-03-13 v3
摘要
给定一个具有连续状态空间和离散动作的环境,我们研究使用 Double Deep Q-learning 强化学习智能体,在 LunarLander-v2 OpenAI gym 环境中寻找最优策略。
引用
@article{arxiv.1708.02378,
title = {Investigating Reinforcement Learning Agents for Continuous State Space Environments},
author = {David Von Dollen},
journal= {arXiv preprint arXiv:1708.02378},
year = {2019}
}