OpenHoldem:面向大规模不完美信息博弈研究的基准平台
机器学习
2021-12-15 v4 人工智能
计算机科学与博弈论
摘要
由于少数研究机构的持续努力,近期在无限注德州扑克(NLTH)——大规模不完美信息博弈研究的主要试验平台——中设计超人类 AI 方面取得了显著进展。然而,由于缺少与现有方法比较的标准基准,新研究者研究该问题仍然具有挑战性,这严重阻碍了该领域的进一步发展。在本工作中,我们提出 OpenHoldem,一个利用 NLTH 进行大规模不完美信息博弈研究的集成工具包。OpenHoldem 对该研究方向做出三项主要贡献:1)用于全面评估不同 NLTH AI 的标准化评估协议,2)四个公开可用的 NLTH AI 强基线,以及 3)带有易用 API 的在线测试平台,用于公开 NLTH AI 评估。我们已在 holdem.ia.ac.cn 发布 OpenHoldem,希望它能促进对该领域未解决理论与计算问题的进一步研究,并培育对手建模与人机交互学习等关键研究问题。
引用
@article{arxiv.2012.06168,
title = {OpenHoldem: A Benchmark for Large-Scale Imperfect-Information Game Research},
author = {Kai Li and Hang Xu and Enmin Zhao and Zhe Wu and Junliang Xing},
journal= {arXiv preprint arXiv:2012.06168},
year = {2021}
}