中文

细粒度决策理论搜索控制

人工智能 2013-04-05 v1

摘要

搜索的决策理论控制先前将生成和评估完整后继集作为其基本计算单元。虽然这简化了分析,但也导致了一些剪枝和满意决策的机会损失。因此,本文将对计算价值的分析扩展到单个后继评估。所使用的分析技术可能对更一般环境中的推理控制有用。我们推导了一个公式,用于计算一个节点(其n个后继中有k个已被评估)的期望价值。该公式用于估计扩展更多后继的价值,利用了早期工作中开发的博弈中计算价值的一般公式。我们展示了MGSS*算法的改进版本,并给出了奥赛罗游戏的实证结果。

关键词

引用

@article{arxiv.1304.1133,
  title  = {Fine-Grained Decision-Theoretic Search Control},
  author = {Stuart Russell},
  journal= {arXiv preprint arXiv:1304.1133},
  year   = {2013}
}

备注

Appears in Proceedings of the Sixth Conference on Uncertainty in Artificial Intelligence (UAI1990)