中文

大语言模型中的政治意识形态迁移

计算与语言 2025-08-25 v1

摘要

大语言模型(LLMs)正在被部署到政治敏感场景中,引发对其潜在编码、放大或被引导向特定意识形态的担忧。我们调查了采用合成人格如何影响LLMs在意识形态表达上的变化,涵盖7个不同家族的7B至70B+参数模型,采用Political Compass Test作为标准化探针。我们的分析揭示了四个一致模式:(i)更大的模型呈现更广泛且更极端的隐式意识形态覆盖;(ii)对明确意识形态线索的易受性随规模增长;(iii)模型对右极权主义 priming的反应强于对左自由主义 priming;(iv)人格描述中的主题内容诱导系统且可预测的意识形态迁移,随规模增大而放大。这些发现表明,规模与人格内容均塑造了LLM的政治行为。作为这些系统进入决策、教育和政策情境,其潜在的意识形态可塑性要求关注公平性、透明性及安全性。

关键词

引用

@article{arxiv.2508.16013,
  title  = {Political Ideology Shifts in Large Language Models},
  author = {Pietro Bernardelle and Stefano Civelli and Leon Fröhling and Riccardo Lunardi and Kevin Roitero and Gianluca Demartini},
  journal= {arXiv preprint arXiv:2508.16013},
  year   = {2025}
}