中文

基于多智能体强化学习的高效拼车调度

机器学习 2020-06-22 v1 多智能体系统 机器学习

摘要

随着拼车服务的出现,依赖其满足各种需求的人数大幅增加。早期解决该问题的方法大多需要手工设计函数来估计行程时间和乘客等待时间。传统的基于强化学习(RL)的方法试图解决拼车问题,但无法准确建模出租车运行的复杂环境。先前基于独立DQN(IDQN)的多智能体深度RL方法学习分散的价值函数,由于多个智能体的并发学习与探索而易于不稳定。我们提出的基于QMIX的方法能够实现集中训练与分散执行。我们表明,我们的模型在固定网格尺寸上优于IDQN基线,并且能很好地泛化到更小或更大的网格尺寸。此外,在我们的每个回合中乘客和车辆数量可变的场景下,我们的算法也能够优于IDQN基线。我们的论文代码公开于:https://github.com/UMich-ML-Group/RL-Ridesharing。

关键词

引用

@article{arxiv.2006.10897,
  title  = {Efficient Ridesharing Dispatch Using Multi-Agent Reinforcement Learning},
  author = {Oscar de Lima and Hansal Shah and Ting-Sheng Chu and Brian Fogelson},
  journal= {arXiv preprint arXiv:2006.10897},
  year   = {2020}
}