中文

机器人团队中用于合作行动选择的虚拟博弈

多智能体系统 2016-11-18 v1

摘要

针对机器人团队中的控制努力分配问题,提出一种基于虚拟博弈新变体的博弈论分布式决策方法。所提出的学习过程使机器人能够通过协调其行动来高效完成任务,从而实现其目标。具体而言,团队中的每个机器人预测其他机器人的计划行动,同时做出决策以最大化自身期望奖励,该奖励取决于任务联合成功完成的回报。行动选择被解释为一个 n 人合作博弈。所提出的方法可视为信念-愿望-意图(BDI)框架的一部分,若恰当定义机器人的个体和群体奖励,该方法还能解决机器人的合作、合法、安全、体贴和共情决策问题。经过理论分析后,所提算法的性能在四个仿真场景中进行了测试。第一个场景是两个物料搬运机器人之间的协调博弈,第二个场景是机器人团队的仓库巡逻任务,第三个场景展示了两个机器人在走廊上搬运重物的协调机制,第四个场景是传感器网络上的协调示例。

关键词

引用

@article{arxiv.1611.05638,
  title  = {Fictitious play for cooperative action selection in robot teams},
  author = {Michalis Smyrnakis and Sandor M. Veres},
  journal= {arXiv preprint arXiv:1611.05638},
  year   = {2016}
}

备注

arXiv admin note: text overlap with arXiv:1301.3347