领导者-跟随者网络中的近最优控制策略:线性二次型平均场团队案例研究
最优化与控制
2020-12-02 v1
摘要
本文研究了一个由一个领导者和多个同质跟随者组成的分散随机控制系统。领导者与跟随者在动态和代价上均耦合,其中动态为线性,代价函数关于领导者和跟随者的状态与动作是二次的。领导者与跟随者的目标是在最小化通信与能量代价的同时达成共识。领导者知晓其本地状态,每个跟随者知晓其本地状态及领导者状态。实现该分散信息结构所需链路数等于跟随者数量,而这是通信图连通所需的最小链路数。在无领导者的特殊情况下,跟随者之间无需链路,即通信图甚至不连通。我们提出了一种近最优控制策略,其随跟随者数量增加收敛至最优解。所提方案的一个显著特点是提供了设计方案,其中可通过选择适当的代价函数来设计收敛速率以及跟随者的集体行为。此外,所提方案的计算复杂度不依赖于跟随者数量。进一步地,所提策略可以分布式计算,领导者求解一个Riccati方程,每个跟随者求解两个Riccati方程以计算其策略。提供了两个数值例子以证明结果在多智能体系统控制中的有效性。
引用
@article{arxiv.2012.00260,
title = {Near-Optimal Control Strategy in Leader-Follower Networks: A Case Study for Linear Quadratic Mean-Field Teams},
author = {Mohammad M. Baharloo and Jalal Arabneydi and Amir G. Aghdam},
journal= {arXiv preprint arXiv:2012.00260},
year = {2020}
}
备注
Proceedings of IEEE Conference on Decision and Control, 2018