中文

关于过参数化策略在LQR问题中近似全局指数收敛性的研究

最优化与控制 2025-10-03 v1 系统与控制 系统与控制

摘要

本文研究了梯度方法在非凸优化问题中的收敛性——具体而言,问题表述对解的梯度流解决方案收敛行为的影响。我们通过一个简单例子表明,惊讶地,梯度流解可以是指数收敛或渐近收敛,取决于问题的表述方式。随后,我们深化了分析,表明针对连续时间线性二次调节器(LQR)的策略优化策略(已知在全局仅呈渐近收敛)在通过线性前馈神经网络(LFFNN)进行过参数化后,呈现近乎全局的指数收敛。我们证明了这一质变改善总是发生在LQR问题的简化版本中,并推导了梯度流的显式收敛率。最后,我们通过数值仿真表明,质变改善和量化收敛率提升在一般LQR中仍然有效。

关键词

引用

@article{arxiv.2510.02140,
  title  = {On the (almost) Global Exponential Convergence of the Overparameterized Policy Optimization for the LQR Problem},
  author = {Moh Kamalul Wafi and Arthur Castello B. de Oliveira and Eduardo D. Sontag},
  journal= {arXiv preprint arXiv:2510.02140},
  year   = {2025}
}

备注

This version is currently under review for the 2026 IEEE American Control Conference (ACC)