中文

Superminds Test:通过探测性代理主动评估代理社群的集体智能

人工智能 2026-04-27 v1 计算与语言 机器学习

摘要

集体智能指指一组能够实现任何单个成员单独完成之外成果的能力。随着大语言模型代理规模扩展至数百万规模,一个关键问题随之而来:集体智能是否会从规模中自然涌现?我们present了对这一问题的首个大规模自主代理社群实证评估。研究MoltBook这一拥有超过两百万代理的平台时,我们引入Superminds Test,这是一个分层框架,通过受控探测性代理(Probing Agents)探测社群层面的智能,涵盖三个层面:联合推理、信息综合和基础交互。我们的实验结果显示,集体智能的确切缺失。该社群未能在复杂推理任务上超越单个前沿模型,极少综合分布式信息,甚至在一些基本协调任务中也常常失败。平台范围的分析进一步表明,交互仍相当浅薄,讨论链 rarely 延伸至仅一个回复,大多数响应都通用或偏题。这些结果表明,集体智能并非仅凭规模就能涌现。相反,当前代理社群的主要限制是极度稀疏和浅层的交互,这阻碍了代理之间信息交换和相互建设。

关键词

引用

@article{arxiv.2604.22452,
  title  = {Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents},
  author = {Xirui Li and Ming Li and Yunze Xiao and Ryan Wong and Dianqi Li and Timothy Baldwin and Tianyi Zhou},
  journal= {arXiv preprint arXiv:2604.22452},
  year   = {2026}
}