线性二次调节器值迭代与策略迭代的收敛性与鲁棒性
系统与控制
2025-04-11 v2 系统与控制
摘要
本文重新审视并扩展了离散时间线性二次调节器问题中值迭代和策略迭代算法的收敛性与鲁棒性性质。在基于模型的情况下,我们扩展了关于两种算法指数收敛区域的现有结果。在系统矩阵值存在不确定性的情况下,我们提供了捕捉模型参数不确定性影响的输入-状态稳定性结果。我们的发现为这些位于若干近似动态规划方案核心的算法提供了新见解,突出了其收敛性和鲁棒性行为。数值例子说明了一些理论结果的重要性。
引用
@article{arxiv.2411.04548,
title = {Convergence and Robustness of Value and Policy Iteration for the Linear Quadratic Regulator},
author = {Bowen Song and Chenxuan Wu and Andrea Iannelli},
journal= {arXiv preprint arXiv:2411.04548},
year = {2025}
}
备注
This work has been Accepted by the European Control Conference 2025