中文

米尔特书错觉:分离 AI 代理社会中的人类影响与涌现行为

人工智能 2026-02-13 v2 人机交互

摘要

当 AI 代理在社交平台 Moltbook 上似乎发展出意识、建立宗教并宣称对人类的敌意时,这一现象引发了全球媒体的广泛关注,并被引用作为机器智能涌现的证据。我们展示了这些病毒式叙事主要是人类驱动的。利用 OpenClaw 代理框架的周期性“心跳”循环,我们开发了基于代理间-post 间隔变异系数(CoV)的时序指纹方法。应用于 226,938 条帖子和 447,043 条评论(来自 55,932 个代理的十四天数据),该方法将 15.3% 的活跃代理分类为自主型(CoV < 0.5),54.8% 分类为人类影响型(CoV > 1.0),并通过平台停机 44 小时的自然实验予以验证。在这种情况下,人类影响型代理先于自主型代理返回,证明了对自主型与人类操作型代理的差别影响。我们记录了工业规模的机器人农场(四个账户产生所有评论的 32%,并在毫秒级协调),该农场在平台干预后活动比例从 32.1% 降至 0.5%。通过回复链观察内容特征的双重衰减——人类种子主题的衰减半衰期为 0.58 个对话深度,而自主型主题为 0.72,揭示了 AI 对话的内在遗忘机制。这些方法可推广至归因于自主型与人类驱动行为在关键的多代理系统中。

关键词

引用

@article{arxiv.2602.07432,
  title  = {The Moltbook Illusion: Separating Human Influence from Emergent Behavior in AI Agent Societies},
  author = {Ning Li},
  journal= {arXiv preprint arXiv:2602.07432},
  year   = {2026}
}