中文

基于阶段式牛顿法的具有不完全状态观测的动态博弈控制

最优化与控制 2022-06-24 v1

摘要

在本信中,我们研究具有不完全状态观测的动态博弈最优控制,并引入一种迭代方法以寻找局部纳什均衡。该算法由一个迭代过程组成,结合了类似于极小极大微分动态规划的逆向递归与类似于风险敏感 Kalman 平滑器的正向递归。一个耦合方程使所得控制依赖于估计。最终,该算法等价于一个牛顿步但具有关于时间 horizon 长度的线性复杂度。此外,引入了一个价值函数与线搜索过程以保证迭代格式的收敛。所得控制器通过为最坏情况扰动做规划来推理不确定性。最后,所提算法的低计算成本使其成为在复杂系统上以高频进行输出反馈模型预测控制的有前景的方法。在真实机器人问题上的数值仿真说明了所得控制器的风险敏感行为。

关键词

引用

@article{arxiv.2206.11341,
  title  = {Stagewise Newton Method for Dynamic Game Control with Imperfect State Observation},
  author = {Armand Jordana and Bilal Hammoud and Justin Carpentier and Ludovic Righetti},
  journal= {arXiv preprint arXiv:2206.11341},
  year   = {2022}
}