中文

分布鲁棒路径积分控制

系统与控制 2023-10-04 v1 系统与控制

摘要

我们考虑一个连续时间连续空间随机最优控制问题,其中控制器缺乏底层扩散过程的精确知识,而是依赖于一组有限的历史扰动轨迹。在数据收集受限的情况下,由经验数据综合得到的控制器可能表现出较差的性能。为解决此问题,我们提出一种名为分布鲁棒路径积分(DRPI)的新方法。该方法采用分布鲁棒优化(DRO)使所得策略对未知扩散过程具有鲁棒性。值得注意的是,DRPI 方案与风险敏感控制有相似之处,这使我们能够利用路径积分控制(PIC)框架作为高效求解方案。我们推导了 DRPI 方案的理论性能保证,其与在风险敏感控制中选择风险参数密切相关。我们验证了方案的有效性,并展示了在缺乏真实扩散过程时,相较于风险中性 PIC 策略的优越性。

关键词

引用

@article{arxiv.2310.01633,
  title  = {Distributionally Robust Path Integral Control},
  author = {Hyuk Park and Duo Zhou and Grani A. Hanasusanto and Takashi Tanaka},
  journal= {arXiv preprint arXiv:2310.01633},
  year   = {2023}
}