中文

不完美信息博弈中的深度受限求解

计算机科学与博弈论 2018-05-23 v1 人工智能 多智能体系统

摘要

不完美信息博弈中的一个根本挑战是状态没有定义良好的值。因此,用于单智能体环境与完美信息博弈的深度受限搜索算法并不适用。本文引入一种在不完美信息博弈中进行深度受限求解的原则性方法,即在深度限制处允许对手从若干剩余博弈策略中选择。这些策略各自导致叶节点的一组不同值。这迫使智能体对对手可能采用的多种策略保持鲁棒。我们通过构建一个大师级单挑无限注德州扑克 AI 证明了该方法的有效性,该 AI 仅使用 4 核 CPU 与 16 GB 内存便击败了两个先前顶尖的智能体。此前开发如此强大的智能体需要超级计算机。

关键词

引用

@article{arxiv.1805.08195,
  title  = {Depth-Limited Solving for Imperfect-Information Games},
  author = {Noam Brown and Tuomas Sandholm and Brandon Amos},
  journal= {arXiv preprint arXiv:1805.08195},
  year   = {2018}
}