中文

KnowSR:多智能体强化学习中同构智能体间的知识共享

人工智能 2021-05-26 v1 机器学习 多智能体系统

摘要

近年来,深度强化学习(RL)算法在多智能体领域取得了巨大进展。然而,由于 RL 的特性,复杂任务的训练将耗费大量资源和时间。为应对这一挑战,同构智能体间的互学习策略至关重要,但以往研究对此探索不足,因为大多数现有方法未考虑利用智能体模型的知识。本文中,我们提出了一种适用于大多数多智能体强化学习(MARL)算法的适配方法 KnowSR,其利用了智能体间学习的差异。我们采用知识蒸馏(KD)的思想在智能体间共享知识,以缩短训练阶段。为实证展示 KnowSR 的鲁棒性与有效性,我们在协作与竞争场景下对最先进的 MARL 算法进行了大量实验。结果表明 KnowSR 优于近期报道的方法,强调了所提出的知识共享对 MARL 的重要性。

关键词

引用

@article{arxiv.2105.11611,
  title  = {KnowSR: Knowledge Sharing among Homogeneous Agents in Multi-agent Reinforcement Learning},
  author = {Zijian Gao and Kele Xu and Bo Ding and Huaimin Wang and Yiying Li and Hongda Jia},
  journal= {arXiv preprint arXiv:2105.11611},
  year   = {2021}
}