中文

多主之仆:帕累托最优序贯决策中的优先级转移

人工智能 2017-11-02 v1

摘要

常有人认为,代表两个或更多具有不同效用函数的委托人做决策的智能体应当采用一种{\em 帕累托最优}策略,即无法在不损害另一方的情况下改善某一方的策略。Harsanyi 的一个著名定理表明,当委托人对所有策略的结果分布具有共同先验时,智能体的帕累托最优策略是最大化委托人效用的固定加权线性组合的策略。本文中,我们证明 Harsanyi 定理在委托人具有不同先验时不成立,并推导出一个成立且更精确的推广,这构成了我们的主要结果。在这一更一般的情况下,赋予各委托人效用的相对权重应随时间演化,其依据是该智能体的观测在多大程度上符合该委托人的先验。该结果对合同、条约、合资企业和机器人的设计具有启示意义。

关键词

引用

@article{arxiv.1711.00363,
  title  = {Servant of Many Masters: Shifting priorities in Pareto-optimal sequential decision-making},
  author = {Andrew Critch and Stuart Russell},
  journal= {arXiv preprint arXiv:1711.00363},
  year   = {2017}
}

备注

10 pages. arXiv admin note: substantial text overlap with arXiv:1701.01302