基于强化学习的Chrome恐龙跑酷游戏
人工智能
2020-08-19 v1 机器学习
摘要
强化学习是人类已知最先进的算法集合之一,可在游戏中与人类匹敌甚至表现更优。本文中,我们研究最流行的无模型强化学习算法,并结合卷积神经网络来训练智能体游玩Chrome恐龙跑酷游戏。我们采用了两种流行的时序差分方法,即深度Q学习和期望SARSA,并实现了Double DQN模型来训练智能体,最后根据回合得分和算法在时间步上的收敛性进行比较。
引用
@article{arxiv.2008.06799,
title = {Chrome Dino Run using Reinforcement Learning},
author = {Divyanshu Marwah and Sneha Srivastava and Anusha Gupta and Shruti Verma},
journal= {arXiv preprint arXiv:2008.06799},
year = {2020}
}