中文

更广义的潘多拉规则?

最优化与控制 2015-10-01 v1

摘要

在 Weitzman 分析的一个经典模型中,代理人面对装有奖品的盒子。她可以以任意顺序打开盒子,发现其中的奖品,并最优停止。她希望最大化所发现最大奖品的期望值减去开盒成本。该问题由所谓的潘多拉规则解决,并应用于寻找房屋或工作。然而,这并未建模这样一个学生的问题:该学生搜索要选为主修科目的课程,并从搜索期间所修的所有课程中获益。受此启发,我们询问是否存在这样的问题:当目标为所有已发现奖品的更一般函数时,广义潘多拉规则是最优的。我们表明,若广义潘多拉规则对所有成本和奖品分布的设定都是最优的,则目标函数必须取一种特殊形式。我们还解释了如何将 Gittins 指数定理应用于等价的多臂老虎机问题,以证明潘多拉规则对学生问题的最优性。但我们也表明,确实存在一些非多臂老虎机类型的问题,潘多拉规则对其是最优的。

关键词

引用

@article{arxiv.1509.09095,
  title  = {A more general Pandora's rule?},
  author = {Wojciech Olszewski and Richard Weber},
  journal= {arXiv preprint arXiv:1509.09095},
  year   = {2015}
}

备注

23 pages