利用强化学习玩 2048
人工智能
2021-10-22 v1
摘要
2048 游戏是一款极易上瘾的游戏。它易于学习,但难以精通,因为已创建的该游戏显示,在数亿局已玩过的游戏中仅有约 1% 获胜。在本文中,我们想探索强化学习技术来获胜 2048。我们采取的方法包括深度 Q 学习(deep Q-learning)和集束搜索(beam search),其中集束搜索在 28.5% 的时间内达到 2048。
引用
@article{arxiv.2110.10374,
title = {Playing 2048 With Reinforcement Learning},
author = {Shilun Li and Veronica Peng},
journal= {arXiv preprint arXiv:2110.10374},
year = {2021}
}