中文

基于强化学习的Chrome恐龙跑酷游戏

人工智能 2020-08-19 v1 机器学习

摘要

强化学习是人类已知最先进的算法集合之一,可在游戏中与人类匹敌甚至表现更优。本文中,我们研究最流行的无模型强化学习算法,并结合卷积神经网络来训练智能体游玩Chrome恐龙跑酷游戏。我们采用了两种流行的时序差分方法,即深度Q学习和期望SARSA,并实现了Double DQN模型来训练智能体,最后根据回合得分和算法在时间步上的收敛性进行比较。

关键词

引用

@article{arxiv.2008.06799,
  title  = {Chrome Dino Run using Reinforcement Learning},
  author = {Divyanshu Marwah and Sneha Srivastava and Anusha Gupta and Shruti Verma},
  journal= {arXiv preprint arXiv:2008.06799},
  year   = {2020}
}