中文

基于知识蒸馏的仿人多智能体导航

机器人学 2023-08-30 v5 机器学习

摘要

尽管多智能体导航领域取得了显著进展,智能体仍缺乏人类在多智能体环境中展现的复杂性与智能。本文中,我们提出一个框架,用于在完全去中心化的多智能体环境中学习用于智能体间交互的仿人通用避碰策略。我们的方法使用知识蒸馏与强化学习,基于通过行为克隆从人类轨迹演示中提取的专家策略来塑造奖励函数。我们表明,用我们的方法训练的智能体能在避碰与面向目标的转向任务中采取类人轨迹(这些任务未由演示提供),其表现优于专家以及未使用知识蒸馏训练的基于学习的智能体。

关键词

引用

@article{arxiv.2103.10000,
  title  = {Human-Inspired Multi-Agent Navigation using Knowledge Distillation},
  author = {Pei Xu and Ioannis Karamouzas},
  journal= {arXiv preprint arXiv:2103.10000},
  year   = {2023}
}

备注

IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2021