利用深度强化学习启发式方法求解协作Dec-POMDP
机器学习
2024-09-02 v6 人工智能
多智能体系统
摘要
WQMIX、QMIX、QTRAN和VDN是求解Dec-POMDP的最先进算法。它们均无法解决复杂的智能体协作领域问题。我们给出了一种解决此类问题的算法。在第一阶段,我们求解单智能体问题并获得一个策略。在第二阶段,我们利用该单智能体策略求解多智能体问题。在复杂的智能体协作领域中,SA2MA相比所有竞争对手具有明显优势。
引用
@article{arxiv.2211.15411,
title = {Solving Collaborative Dec-POMDPs with Deep Reinforcement Learning Heuristics},
author = {Nitsan Soffair},
journal= {arXiv preprint arXiv:2211.15411},
year = {2024}
}
备注
Paper has been not finished