关于滚动时域中最小化遗憾的保证
系统与控制
2023-06-27 v1 系统与控制
摘要
为了桥接经典最优控制与在线学习,遗憾最小化最近被提出作为一种控制设计准则。这种竞争范式相对于先知策略所选择的最优控制作用来惩罚损失,并允许在事后跟踪最优性能,无论扰动如何生成。在本文中,我们提出了首个基于重复计算有限时域遗憾最优策略的滚动时域方案,并建立了所得闭环系统的稳定性与安全性保证。我们的推导将先知策略的新单调性性质与合适的终端项相结合。我们证明了我们的方案是递归可行的、稳定的,并且相对于无限时域先知策略实现了有界遗憾。最后,我们展示了该策略优化问题可通过凸凹规划高效求解。我们的数值实验表明,当扰动很不契合经典设计假设时——即使有限时域规划被较低频地重新计算——最小化遗憾也能优于标准滚动时域方法。
引用
@article{arxiv.2306.14561,
title = {On the Guarantees of Minimizing Regret in Receding Horizon},
author = {Andrea Martin and Luca Furieri and Florian Dörfler and John Lygeros and Giancarlo Ferrari-Trecate},
journal= {arXiv preprint arXiv:2306.14561},
year = {2023}
}