中文

基于意图与时效双重对齐的通信延迟容错多智能体协作

高能物理 - 实验 2025-08-01 v3

摘要

通信广泛用于增强多智能体协作。以往的研究通常假设无延迟的通信,这在实际中富有挑战性。然而,实际的智能体因信道延迟而接收在不同时间点发送的消息,称为异步通信,导致认知偏差和协作失效。本文首先定义了 MARL 中的两种通信延迟设置,并强调其对协作的危害。为了处理上述延迟,本文提出了一种新框架,通信延迟容错多智能体协作(CoDe)。首先,CoDe 通过未来动作推断学习意图表示作为消息,反映智能体稳定的未来行为趋势。然后,CoDe 设计了意图与时效的双重对齐机制,以加强异步消息的融合过程。如此一来,智能体可以从延迟的消息中提取他人的长期意图,并选择利用与其意图最相关的最新消息。实验结果表明,CoDe 在没有延迟的三个 MARL 基准测试中优于基线算法,并在固定延迟和时变延迟下表现出鲁棒性。

关键词

引用

@article{arxiv.2501.05206,
  title  = {Direct observation of coherent elastic antineutrino-nucleus scattering},
  author = {N. Ackermann and H. Bonet and A. Bonhomme and C. Buck and K. Fülber and J. Hakenmüller and J. Hempfling and G. Heusser and M. Lindner and W. Maneschg and K. Ni and M. Rank and T. Rink and E. Sánchez Garcıa and I. Stalder and H. Strecker and R. Wink and J. Woenckhaus},
  journal= {arXiv preprint arXiv:2501.05206},
  year   = {2025}
}

备注

27 pages, 10 figures, 4 tables