中文

基于多智能体强化学习的无线 MAC 协议涌现

信息论 2022-06-09 v2 人工智能 math.IT

摘要

在本文中,我们提出一个新框架,利用多智能体深度确定性策略梯度(MADDPG)算法,使基站(BS)和用户设备(UE)能在多址场景中制定出媒体访问控制(MAC)协议。在该框架中,BS 和 UE 是强化学习(RL)智能体,需要学会协作以传输数据。网络节点可交换控制消息来协作并跨网络传输数据,但事先并未就控制消息的含义达成任何协议。在此类框架中,智能体不仅必须学习信道接入策略,还须学习信令策略。通过将所提算法与移除智能体间通信或中心评论家的简化版本进行比较,表明了智能体间协作的重要性。与无竞争基线的对比显示,我们的框架在有效吞吐量方面实现了更优性能,并可有效用于学习新协议。

关键词

引用

@article{arxiv.2108.07144,
  title  = {The Emergence of Wireless MAC Protocols with Multi-Agent Reinforcement Learning},
  author = {Mateus P. Mota and Alvaro Valcarce and Jean-Marie Gorce and Jakob Hoydis},
  journal= {arXiv preprint arXiv:2108.07144},
  year   = {2022}
}

备注

Submitted to Globecom Workshops 2021