中文

通过端到端策略与乐观平滑虚拟对弈掌握策略卡牌游戏(Legends of Code and Magic)

机器学习 2023-03-08 v1 人工智能 计算机科学与博弈论

摘要

深度强化学习结合虚拟对弈在许多基准游戏中展现出令人印象深刻的成果,然而其中大多数游戏为单阶段。相比之下,现实世界决策问题可能由多阶段组成,各阶段的观测空间与动作空间可完全不同。我们研究了一款两阶段策略卡牌游戏 Legends of Code and Magic,并提出一种端到端策略以应对多阶段游戏中出现的困难。我们还提出一种乐观平滑虚拟对弈算法,以求解该双人游戏的纳什均衡。我们的方法赢得了 COG2022 竞赛的双冠军。大量研究验证并展示了我们方法的先进性。

关键词

引用

@article{arxiv.2303.04096,
  title  = {Mastering Strategy Card Game (Legends of Code and Magic) via End-to-End Policy and Optimistic Smooth Fictitious Play},
  author = {Wei Xi and Yongxin Zhang and Changnan Xiao and Xuefeng Huang and Shihong Deng and Haowei Liang and Jie Chen and Peng Sun},
  journal= {arXiv preprint arXiv:2303.04096},
  year   = {2023}
}