中文

仅需一次对齐:通过种子智能体在多智能体系统中传播合作行为

多智能体系统 2026-05-28 v1 计算与语言

摘要

在分布式开放的多智能体系统中,确保智能体行为始终具有挑战性,尤其当人口规模扩大且可能存在未对齐的智能体时。我们展示了单个已对齐智能体可以通过自然语言交互纯粹向未训练的智能体传播合作行为,一种我们称之为对齐传播的现象。我们在红黑游戏中进行研究,这是一个基于团队的迭代囚徫困境,其中团队成员协商并投票决定其集体行动。通过将教师模型的合作推理和说服对话蒸馏到Qwen-3-14B,我们获得了一个种子智能体,当置于四个未训练的队友中时,将合作率从24.8%提升至62.2%,甚至超过教师模型和基础Gemini-3.1-Pro。惊人的是,仅在红黑游戏上训练的种子智能体可零样本迁移到糖格子,一款包含两两交易的空间 grounded 生存模拟,实现91.5%的交易成功率,远超21.6%的基线。我们的结果重新定义了多智能体对齐,从 exhaustive per-agent training 问题转向可以通过战略种子放置工程的可扩展社会能力。

关键词

引用

@article{arxiv.2605.27586,
  title  = {You Only Align Once: Propagating Cooperative Behaviors in Multi-Agent Systems through Seed Agents},
  author = {Nicole Hsing and Asuka Yuxi Zheng and Yi Zhao and Haoqin Tu and Jen-Tse Huang},
  journal= {arXiv preprint arXiv:2605.27586},
  year   = {2026}
}