中文

猜疑论者在主流 Reddit 上的语言

社会与信息网络 2026-04-22 v2 计算机与社会

摘要

边缘子文化与主流在线社区之间的互动为理解社交媒体话语带来了重大挑战。本文调查是否存在针对活跃于猜疑关注社区的用户在一般兴趣空间(如新闻、幽默或兴趣论坛)中的可检测语言特征。我们分析了超过 5000 万条评论、跨越 10 年 Reddit 活动的大规模纵向数据集,检验这些用户在多样社交语境下的通信模式,独立于讨论的话题。我们表明,这些用户表现出独特的语言模式,使机器学习模型能够可靠地在单个社区中将其与总体人群区分开来(在 20 个以上二元分类任务中平均达到 87% 的准确率)。关键的是,没有单个聚合模型能够跨社区捕获这些模式,社区特定模型的性能比全局分类器高出最高 17 个百分点。这一结果表明,虽然这些用户是独特的,但他们的语言表达是动态的,并且高度依赖于他们所居住的社交规范。我们的发现表明,针对在线空间需要量身定制的干预措施,因为与猜疑和边缘子文化相关的语言信号在不同社区之间变化,无法通过统一的检测或 moderation 策略有效处理。

关键词

引用

@article{arxiv.2506.05086,
  title  = {Among Us: Language of Conspiracy Theorists on Mainstream Reddit},
  author = {Francesco Corso and Giuseppe Russo and Francesco Pierri and Gianmarco De Francisci Morales},
  journal= {arXiv preprint arXiv:2506.05086},
  year   = {2026}
}

备注

Accepted for publication at ACL 2026