不完美信息博弈中的深度受限求解
计算机科学与博弈论
2018-05-23 v1 人工智能
多智能体系统
摘要
不完美信息博弈中的一个根本挑战是状态没有定义良好的值。因此,用于单智能体环境与完美信息博弈的深度受限搜索算法并不适用。本文引入一种在不完美信息博弈中进行深度受限求解的原则性方法,即在深度限制处允许对手从若干剩余博弈策略中选择。这些策略各自导致叶节点的一组不同值。这迫使智能体对对手可能采用的多种策略保持鲁棒。我们通过构建一个大师级单挑无限注德州扑克 AI 证明了该方法的有效性,该 AI 仅使用 4 核 CPU 与 16 GB 内存便击败了两个先前顶尖的智能体。此前开发如此强大的智能体需要超级计算机。
引用
@article{arxiv.1805.08195,
title = {Depth-Limited Solving for Imperfect-Information Games},
author = {Noam Brown and Tuomas Sandholm and Brandon Amos},
journal= {arXiv preprint arXiv:1805.08195},
year = {2018}
}