中文

时变通信网络下近势博弈中的去中心化虚拟博弈

最优化与控制 2021-03-19 v1 多智能体系统 系统与控制 系统与控制

摘要

我们研究了针对近势博弈类的去中心化虚拟博弈(DFP)的收敛性质,其中智能体的激励几乎与某个势函数对齐。在 DFP 中,智能体仅在一串时变网络中的当前邻居间共享信息,保持对其他智能体经验频率的估计,并基于估计的经验频率采取使自身期望效用函数最大化的行动。我们证明,行动的经验频率收敛到一组策略,其势函数值大于最接近的势博弈的近似纳什均衡所获得的势函数值。该结果确立了 DFP 在近势博弈中具有与标准虚拟博弈相同的收敛保证,在标准虚拟博弈中智能体观察所有其他智能体的过往行动。

关键词

引用

@article{arxiv.2103.09845,
  title  = {Decentralized Fictitious Play in Near-Potential Games with Time-Varying Communication Networks},
  author = {Sarper Aydın and Sina Arefizadeh and Ceyhun Eksin},
  journal= {arXiv preprint arXiv:2103.09845},
  year   = {2021}
}