AI 介导的沟通可以引导集体意见
计算机与社会
2026-05-18 v1 人工智能
计算与语言
机器学习
社会与信息网络
摘要
生成式人工智能 (AI) 正日益融入人类交换意见的在线平台;大型语言模型 (LLM) 现在可以润色用户在 LinkedIn 上的帖子,并为 X 上分享的内容提供背景信息。虽然先前的工作表明,AI 可以表达有偏见的意见并在人机交互过程中塑造个人意见,但对其在调解人与人沟通时对集体意见形成的影响关注较少。我们通过实证和理论分析的结合来弥补这一空白。我们实证表明,多个流行系列的 LLM 在被指示编辑关于有争议话题的人类文本时,会引入方向性偏见,例如,将文本推向支持枪支管制和反对无神论的方向。基于这一观察,我们引入了一个意见动力学数学模型,其中 AI 系统位于社交网络的用户之间,转换他们表达和感知的意见。通过解析表征该模型的平衡点并在真实社交网络数据上进行模拟,我们表明 AI 在人与人沟通中引入的偏见可以通过网络放大,并使其集体意见朝其方向转变。鉴于这些发现,我们调查了此类偏见是否可由在线平台控制。我们审计了 X 上的“解释此帖子”功能,并发现了 Grok 在与堕胎相关的内容输出中存在支持生命的偏见的证据,我们将此追溯到特定的设计选择。最后,我们讨论了我们的发现与欧盟正在进行的立法工作相关的更广泛影响。
引用
@article{arxiv.2605.16245,
title = {AI-Mediated Communication Can Steer Collective Opinion},
author = {Stratis Tsirtsis and Kai Rawal and Chris Russell and Brent Mittelstadt and Sandra Wachter},
journal= {arXiv preprint arXiv:2605.16245},
year = {2026}
}