中文

利用强化学习玩 2048

人工智能 2021-10-22 v1

摘要

2048 游戏是一款极易上瘾的游戏。它易于学习,但难以精通,因为已创建的该游戏显示,在数亿局已玩过的游戏中仅有约 1% 获胜。在本文中,我们想探索强化学习技术来获胜 2048。我们采取的方法包括深度 Q 学习(deep Q-learning)和集束搜索(beam search),其中集束搜索在 28.5% 的时间内达到 2048。

关键词

引用

@article{arxiv.2110.10374,
  title  = {Playing 2048 With Reinforcement Learning},
  author = {Shilun Li and Veronica Peng},
  journal= {arXiv preprint arXiv:2110.10374},
  year   = {2021}
}