中文

离散与连续埋伏博弈:最优策略与近似解

机器人学 2016-12-08 v1

摘要

我们考虑一个自主导航问题,其中一名旅行者试图穿越一个环境,而一名对手则试图在此环境中设置埋伏。引入了一个两人零和博弈。玩家的策略被计算为随机路径分布,其一次实现即为旅行者所选择的路径。我们在旅行者在网络上移动的离散问题与旅行者在平面内移动的连续问题之间建立了类比。推导了解析最优策略。利用最小割-最大流文献中的假设,当埋伏者的奖励函数为均匀时,博弈的最优值被证明与离散和连续情况下环境上的最大流相关。引入了一个线性规划,允许计算与非均匀奖励函数兼容的最优策略。为了放宽计算连续博弈玩家最优策略的假设,受最近引入的基于采样的运动规划技术启发,创建了一个网络,并针对连续约束调整了该线性规划。

关键词

引用

@article{arxiv.1612.02135,
  title  = {Discrete and Continuous ambush games: optimal policies and approximate solutions},
  author = {Emmanuel Boidot and Aude Marzuoli and Eric Feron},
  journal= {arXiv preprint arXiv:1612.02135},
  year   = {2016}
}