中文

FlapAI Bird:使用强化学习技术训练智能体玩 Flappy Bird

人工智能 2020-04-09 v2

摘要

强化学习是自动游戏游玩最流行的方法之一。该方法允许智能体估计其状态的期望效用,以便在未知环境中做出最优动作。我们试图将强化学习算法应用于游戏Flappy Bird。我们实现了SARSA和Q-Learning,并进行了一些修改,如ϵ\epsilon-贪婪策略、离散化和反向更新。我们发现SARSA和Q-Learning优于基线,经常取得1400分以上的成绩,最高游戏内得分为2069。

关键词

引用

@article{arxiv.2003.09579,
  title  = {FlapAI Bird: Training an Agent to Play Flappy Bird Using Reinforcement Learning Techniques},
  author = {Tai Vu and Leon Tran},
  journal= {arXiv preprint arXiv:2003.09579},
  year   = {2020}
}

备注

typos corrected, references added