基于加权信息年龄的网络大规模群体博弈调度
系统与控制
2022-12-29 v2 信息论
网络与互联网体系结构
系统与控制
math.IT
最优化与控制
摘要
在本文中,我们考虑一个离散时间多智能体系统,包含个代价耦合的网络化理性智能体求解一致性问题,以及一个中央基站(BS)调度通过网络进行的智能体通信。由于网络传输数量的硬带宽约束,至多个智能体可同时通过网络访问其状态信息。在关于智能体和BS信息结构的标准假设下,我们首先表明智能体的控制作用没有任何对偶效应,从而允许在每个智能体处实现估计与控制问题的分离。接下来,我们为BS的调度问题提出一种加权信息年龄(WAoI)度量,其中权重依赖于智能体的估计误差。BS旨在寻找在硬带宽约束下最小化WAoI的最优调度策略。由于该问题是NP难的,我们首先将硬约束松弛为软更新率约束,然后通过将其重新表述为马尔可夫决策过程(MDP)来计算松弛问题的最优策略。这进而启发了带宽约束问题的一个次优策略,该策略被证明在时逼近最优策略。接下来,我们使用平均场博弈框架求解一致性问题,其中我们首先为智能体系统(当时)的极限情形设计分散控制策略。通过显式构造平均场系统,我们证明了平均场均衡的存在性与唯一性。因此,我们表明所获得的均衡策略构成了有限智能体系统的-纳什均衡。最后,我们通过数值模拟验证了调度与控制策略的性能。
引用
@article{arxiv.2209.12888,
title = {Weighted Age of Information based Scheduling for Large Population Games on Networks},
author = {Shubham Aggarwal and Muhammad Aneeq uz Zaman and Melih Bastopcu and Tamer Başar},
journal= {arXiv preprint arXiv:2209.12888},
year = {2022}
}
备注
This work has been submitted to IEEE for possible publication