谁先行动?优化多机器人Stackelberg博弈中的行动顺序
机器人学
2024-06-26 v4 人工智能
系统与控制
系统与控制
最优化与控制
摘要
我们考虑多智能体空间导航问题,即计算社会最优的行动顺序(即智能体承诺其决策的序列)及其在N玩家Stackelberg轨迹博弈中的相关均衡。我们将该问题建模为在行动顺序排列所关联的所有可能Stackelberg博弈空间上的混合整数优化问题。为解决该问题,我们引入了分支与博弈(B&P),一种高效且精确的算法,可证明收敛到社会最优的行动顺序及其Stackelberg均衡。作为B&P的子程序,我们采用并扩展了顺序轨迹规划(一种流行的多智能体控制方法),以可扩展的方式为任何给定的行动顺序计算有效的局部Stackelberg均衡。我们展示了B&P在协调空中交通管制、群体编队和配送车辆车队中的实际效用。我们发现B&P始终优于各种基线,并计算出社会最优均衡。
引用
@article{arxiv.2402.09246,
title = {Who Plays First? Optimizing the Order of Play in Stackelberg Games with Many Robots},
author = {Haimin Hu and Gabriele Dragotto and Zixu Zhang and Kaiqu Liang and Bartolomeo Stellato and Jaime F. Fisac},
journal= {arXiv preprint arXiv:2402.09246},
year = {2024}
}
备注
Robotics: Science and Systems (RSS) 2024