中文

人类无法检测 AI 生成的媒体,但社区可能——来自 Reddit r/RealOrAI 的协作式 AI 检测

社会与信息网络 2026-05-26 v1

摘要

我们利用来自 r/RealOrAI 社区一年间的活动数据,研究了人类 AI 检测行为。该社区让用户协作评估视觉媒体是否为真实或 AI 生成。社区由一个机器人进行监管,该机器人会征求提交者对自我挑战“[GUESS]”帖子的验证标签,并发布每篇帖子的社区聚合预测,从而获得大规模的自然语言真实标签。社区在 [GUESS] 帖子上的检测准确率达到 72%,但存在系统性的误报偏差,随着社区对 AI 怀疑的增加,这一偏差会逐年加剧。我们使用由六个 LLM 组成的 ensemble 经过人工标注真实标签验证,对 1 万 条包含推理内容的评论进行分类,涵盖感知特征、上下文、一致性、AI 知识、专业领域知识和来源(追溯媒体来源)六大 cue。感知特征(场景、视觉瑕疵、解剖学物理、光照、行为、文本、音频)占据推理的 70%,而来源验证在个人层面最稀少(4%),但在社区总结中放大了 4.3 倍,揭示了聚合作为一种可靠性过滤器, selectively 滤出诊断性证据。这些发现揭示了基于启发式的方法的检测局限性,表明线上社区如何在日益受到挑战的信息环境中进行集体导航。

关键词

引用

@article{arxiv.2605.24287,
  title  = {Humans Cannot Detect AI-Generated Media But Communities May -- For Now: Collaborative AI Detection in r/RealOrAI on Reddit},
  author = {Tuğrulcan Elmas},
  journal= {arXiv preprint arXiv:2605.24287},
  year   = {2026}
}