中文

大语言模型后的地缘政治视差:超越沃尔特·利普曼

计算机与社会 2025-08-28 v1 计算与语言

摘要

新闻客观性长期以来存在争议,徘徊于中立、基于事实的报道理想与主观框架不可避免性之间。随着大语言模型(LLM)的出现,这种张力如今被算法系统所中介,其训练数据和设计选择本身可能嵌入文化或意识形态偏见。本研究通过比较中文源模型(Qwen、BGE、Jina)和西方源模型(Snowflake、Granite)家族的文章级嵌入,来考察地缘政治视差——新闻质量与主观性评估之间的系统性差异。我们在人工标注的新闻质量基准(涵盖十五维度的风格、信息和情感特征)以及覆盖敏感话题的平行语料库(包括巴勃斯坦议题及中美互报)上进行评估。利用逻辑回归探针和匹配主题评估,我们量化了不同模型家族在预测正类概率上的各维度差异。我们的发现表明,模型来源导致的差异具有一致性且非随机性,符合地缘政治框架。针对巴勃斯坦相关报道,西方模型赋予更高的主观性和积极情感分数,而中文模型更强调新颖性和描述性。跨主题分析显示,中文模型对中美报道在结构性质量指标上显著低于西方模型,尤其在流畅性、简洁性、技术性和整体质量方面,但情感得分呈现更高的负面情感。这些模式与媒体偏见理论一致,并与我们对语义、情感和关系主观性的区分相吻合。本研究扩展了LLM偏见文献,表明地缘政治框架效应在下游质量评估任务中依然存在。我们指出,基于LLM的媒体评估管道需要进行文化校准,以避免将内容差异混为模型引发的偏见。

关键词

引用

@article{arxiv.2508.19492,
  title  = {Geopolitical Parallax: Beyond Walter Lippmann Just After Large Language Models},
  author = {Mehmet Can Yavuz and Humza Gohar Kabir and Aylin Özkan},
  journal= {arXiv preprint arXiv:2508.19492},
  year   = {2025}
}

备注

7 pages, 4 figures, 7 tables