中文

他们的道德是谁的?探讨多语言语言模型中的文化偏见

计算与语言 2024-12-30 v1 人工智能

摘要

大型语言模型(LLM)已成为各类领域中不可或缺的工具,但其在文化和语言语境下的道德推理能力仍鲜有被探讨。本研究考察了多语言语言模型,如 GPT-3.5-Turbo、GPT-4o-mini、Llama 3.1 和 MistralNeMo,是否反映出特定文化背景的道德价值,或是否强加主导性道德规范,尤其是以英语为根基的规范。通过在八种语言(阿拉伯语、菲斯语、英文、西班牙语、日语、中文、法语、俄语)中更新的道德基础问卷(MFQ-2)进行测试,分析了模型对六大核心道德基础的遵循情况:关怀、平等、比例、忠诚、权威与净化。结果显示,文化和语言方面存在显著变异,这挑战了语言模型中普遍道德一致性的假设。尽管某些模型在不同语境下展现出适应性,但其他模型则呈现出受训练数据构成影响的偏见。这一发现凸显了在 culturally inclusive 模型开发中寻求提高多语言 AI 系统公平性与信任度的必要性。

关键词

引用

@article{arxiv.2412.18863,
  title  = {Whose Morality Do They Speak? Unraveling Cultural Bias in Multilingual Language Models},
  author = {Meltem Aksoy},
  journal= {arXiv preprint arXiv:2412.18863},
  year   = {2024}
}