大语言模型中的文化道德规范知识
计算与语言
2023-06-06 v1
摘要
道德规范因文化而异。近期一系列研究表明,英语大语言模型(LLM)包含类人的道德偏见,但这些研究通常未在多元文化环境中考察道德差异。我们探究单语英语语言模型在多大程度上包含关于不同国家道德规范的知识。我们考虑两个分析层面:1)语言模型是否捕捉各国在“同性恋”“离婚”等多种话题上的细粒度道德差异;2)语言模型是否捕捉全球各地人们在道德判断上趋于分歧或一致的文化多样性与共性倾向。我们使用来自世界价值观调查(覆盖 55 国)和 PEW 全球道德调查(覆盖 40 国)的两个公开数据集进行分析。我们发现,预训练英语语言模型对各国经验道德规范的预测劣于先前报道的英语道德规范。然而,在调查数据上微调语言模型可改善跨国推断,但代价是对英语道德规范的估计准确性下降。我们讨论了将文化知识纳入道德规范自动推断的相关性与挑战。
引用
@article{arxiv.2306.01857,
title = {Knowledge of cultural moral norms in large language models},
author = {Aida Ramezani and Yang Xu},
journal= {arXiv preprint arXiv:2306.01857},
year = {2023}
}