中文

LLM文化价值对齐评估

计算机与社会 2025-04-15 v1 人工智能

摘要

随着LLM作为智能代理在涉及人类互动的场景中日益广泛应用,关于LLM是否忠于不同地区文化差异的关键性问题日益凸显。已有研究以各种方式探索了这一问题,发现LLM输出在文化表征上存在偏见。为获得更全面的视角,本文对LLM文化对齐进行首次大规模评估,覆盖20个国家的文化与语言,并涵盖十个LLM。我们采用著名的文化价值问卷,并通过仔细分析LLM输出与人类 ground truth 分数的匹配情况,对LLM在国家间和模型间的文化对齐进行了详尽研究。我们的发现表明,所有模型的输出代表了一种中度的文化中场。鉴于整体偏斜,我们提出了一种对齐指标,揭示美国是最佳对齐国家,GLM-4在文化价值对齐方面能力最佳。更深入的调查揭示了模型来源、提示语言和价值维度对文化输出的影响。具体而言,无论模型来自何处,都能更好地对齐美国,而非中国。这些结论为LLM如何更好地对齐到各种文化提供了见解,也催生了进一步讨论LLM传播文化偏见的潜力,以及需要更具文化适应性的模型。

关键词

引用

@article{arxiv.2504.08863,
  title  = {An Evaluation of Cultural Value Alignment in LLM},
  author = {Nicholas Sukiennik and Chen Gao and Fengli Xu and Yong Li},
  journal= {arXiv preprint arXiv:2504.08863},
  year   = {2025}
}

备注

Submitted to COLM 2025