中文

一种用于在线线性二次控制的迭代 Riccati 算法

最优化与控制 2021-01-27 v2

摘要

研究了线性控制系统的在线策略学习问题。在该问题中,控制系统已知且为线性,一串二次代价函数在后见之明中揭示给控制器,控制器更新其策略以达成次线性后悔值,类似于在线优化。引入了一种改进的在线 Riccati 算法,在某些有界性假设下可导出对数后悔界。特别地,标量情形下的对数后悔在无有界性假设下即可达成。我们的算法在取得更优后悔界的同时,相较于早期依赖每阶段求解半定规划的算法,复杂度也有所降低。

关键词

引用

@article{arxiv.1912.09451,
  title  = {An Iterative Riccati Algorithm for Online Linear Quadratic Control},
  author = {Mohammad Akbari and Bahman Gharesifard and Tamas Linder},
  journal= {arXiv preprint arXiv:1912.09451},
  year   = {2021}
}