中文

探查预训练语言模型中的跨文化价值差异

计算与语言 2025-08-29 v3

摘要

语言蕴含了人们所持的社会、文化与政治价值信息。已有研究探讨了预训练语言模型(PTLMs)中编码的社会及潜在有害偏见。然而,尚无系统性研究考察这些模型中嵌入的价值如何随文化而异。本文中,我们引入探针来研究这些模型嵌入了哪些跨文化价值,以及它们是否与既有理论与跨文化价值调查相一致。我们发现 PTLMs 捕捉了跨文化的价值差异,但这些差异仅与既有价值调查弱对齐。我们讨论了在跨文化场景中误对齐模型的使用影响,以及使 PTLMs 与价值调查对齐的方法。

关键词

引用

@article{arxiv.2203.13722,
  title  = {Probing Pre-Trained Language Models for Cross-Cultural Differences in Values},
  author = {Arnav Arora and Lucie-Aimée Kaffee and Isabelle Augenstein},
  journal= {arXiv preprint arXiv:2203.13722},
  year   = {2025}
}

备注

Accepted to C3NLP, EACL 2023: https://aclanthology.org/2023.c3nlp-1.12/