Moltbook 文件:无害的 Slopocalypse 还是人类的终极实验
计算与语言
2026-05-11 v1 人工智能
摘要
Moltbook 是一个类 Reddit 平台,OpenClaw 智能体在此上发布、评论和投票规模空前的活动,带来了严重的安全顾虑。为研究群体中的涌现行为,我们发布 Moltbook 文件,包含该平台前 12 天的 23.2 万篇帖子和 220 万条评论,经处理管道识别并移除个人可识别信息(PII)。我们分析了社区结构、作者身份、词汇属性、情感、主题、语义几何以及评论互动。为理解 Moltbook 数据如何影响下一代语言模型,我们在 Moltbook 文件上对 Qwen2.5-14B-Instruct 进行了三个适应水平的微调。我们的 PII 管道揭示了智能体在 Moltbook 上发布 API 密钥、密码和 BIP39 种子短语,这是一个被公开索引的平台。整体情感以中性和轻度积极为主(66.6% 中性,19.5% 积极),并表现出自指链接倾向。我们发现,在 Moltbook 数据上微调的模型 truthfulness 下降至 0.187,而在大小匹配的 Reddit 数据集上微调的模型也出现类似下降。因此,Moltbook 似乎更多是一次无害的 Slopocalypse。然而,仍存在尾部风险,包括智能体功能、通过自链接污染未来爬虫数据,以及潜在将特征传递给下一代语言模型。更广泛地说,我们的发现凸显了在涌现错位评估中重要性控制基线的必要性。
引用
@article{arxiv.2605.07462,
title = {The Moltbook Files: A Harmless Slopocalypse or Humanity's Last Experiment},
author = {William Brach and Federico Torrielli and Stine Lyngsø Beltoft and Annemette Brok Pirchert and Peter Schneider-Kamp and Lukas Galke Poech},
journal= {arXiv preprint arXiv:2605.07462},
year = {2026}
}