中文

面向一致信念下有限通信情境下的Dec-POMDP最优性能与动作一致性保证

多智能体系统 2025-12-25 v1 人工智能 机器人学

摘要

多智能体在不确定性下的决策是有效且安全自主运行的基础。在许多实际场景中,每个智能体都维护其对环境的信念并据此进行行动规划。然而,大多数现有方法假设所有智能体在规划时拥有相同的信念,这意味着这些信念基于相同的数据。这种假设在有限通信的情况下往往不切实际。实际中,智能体经常以不一致的信念运行,这可能导致协调不足和次优,甚至不安全的性能。在本文中,我们通过引入一种显式考虑信念不一致性的去中心化框架来解决这一关键挑战,以实现最优的联合动作选择。我们的方法对相对于假设所有数据始终被通信的开放式联合智能体 POMDP(open-loop multi-agent POMDP)的动作一致性和性能提供概率性保证,并有选择地仅在需要时触发通信。此外,我们还关注给定选定的联合动作,代理人是否应共享数据以提高推断的预期性能这一关键问题。仿真结果表明,我们的方法在性能上优于现有最先进算法。

关键词

引用

@article{arxiv.2512.20778,
  title  = {Towards Optimal Performance and Action Consistency Guarantees in Dec-POMDPs with Inconsistent Beliefs and Limited Communication},
  author = {Moshe Rafaeli Shimron and Vadim Indelman},
  journal= {arXiv preprint arXiv:2512.20778},
  year   = {2025}
}

备注

9 pages, 3 figures, 2 tables