FlapAI Bird:使用强化学习技术训练智能体玩 Flappy Bird
人工智能
2020-04-09 v2
摘要
强化学习是自动游戏游玩最流行的方法之一。该方法允许智能体估计其状态的期望效用,以便在未知环境中做出最优动作。我们试图将强化学习算法应用于游戏Flappy Bird。我们实现了SARSA和Q-Learning,并进行了一些修改,如-贪婪策略、离散化和反向更新。我们发现SARSA和Q-Learning优于基线,经常取得1400分以上的成绩,最高游戏内得分为2069。
引用
@article{arxiv.2003.09579,
title = {FlapAI Bird: Training an Agent to Play Flappy Bird Using Reinforcement Learning Techniques},
author = {Tai Vu and Leon Tran},
journal= {arXiv preprint arXiv:2003.09579},
year = {2020}
}
备注
typos corrected, references added