中文

多维马尔可夫决策过程中的百分位数查询

计算机科学中的逻辑 2016-12-08 v3

摘要

具有多维权重的马尔可夫决策过程(MDP)可用于分析具有多个可能冲突目标且需要权衡分析的系统。我们研究了此类 MDP 中百分位数查询的复杂性,并给出了合成强制执行此类约束的策略的算法。给定一个多维加权 MDP、一个定量收益函数 ff、阈值 viv_i(每维一个)以及概率阈值 αi\alpha_i,我们展示了如何计算单一策略,以强制执行对于所有维度 ii,满足 fi(ρ)vif_i(\rho) \geq v_i 的结果 ρ\rho 的概率至少为 αi\alpha_i。我们考虑了文献中经典的定量收益(sup, inf, lim sup, lim inf, mean-payoff, truncated sum, discounted sum)。我们的工作将 Etessami 等人在无权 MDP 中研究的多目标模型检测问题扩展到了定量情形。

关键词

引用

@article{arxiv.1410.4801,
  title  = {Percentile Queries in Multi-Dimensional Markov Decision Processes},
  author = {Mickael Randour and Jean-François Raskin and Ocan Sankur},
  journal= {arXiv preprint arXiv:1410.4801},
  year   = {2016}
}

备注

Extended version of CAV 2015 paper