小型稀疏 UAV 群对关键数据动态一次性递送:MARL 规模研究的模型问题
系统与控制
2026-05-11 v2 人工智能
计算机科学与博弈论
多智能体系统
系统与控制
摘要
本 work 研究了将多智能体强化学习 (MARL) 应用于无人机群体的去中心化控制,以中继关键数据包到已知位置。为此,引入一族确定性游戏,旨在 MARL 规模研究。提出了稳健的基线策略,该策略限制智能体运动并应用 Dijkstra 最短路径算法。计算实验结果表明,两款商用的 MARL 算法在智能体数量较小时表现与基线相competitive, but 随着智能体数量增加面临规模问题。源代码和动画可在 https://github.com/mikapersson/Information-Relaying 在线获取。
关键词
引用
@article{arxiv.2512.09682,
title = {Dynamic one-time delivery of critical data by small and sparse UAV swarms: a model problem for MARL scaling studies},
author = {Mika Persson and Jonas Lidman and Jacob Ljungberg and Samuel Sandelius and Adam Andersson},
journal= {arXiv preprint arXiv:2512.09682},
year = {2026}
}
备注
Accepted to the 2026 IFAC World Congress