大语言模型作为社会道德标准的镜像
人工智能
2024-12-03 v1 计算与语言
符号计算
摘要
先前的研究表明,语言模型在多种文化背景下能以有限程度代表道德规范。本研究旨在复制这些发现并进一步探索其有效性,聚焦诸如“同性恋”和“离婚”等议题。本研究使用来自 40 多个国家的 WVS 和 PEW 调查数据,对这些模型的效果进行评估。结果表明,单语言模型和多语言模型都存在偏见,通常未能准确捕捉多元文化中道德细微差别。然而,BLOOM 模型表现最佳,展现出一定的积极相关性,但仍未实现全面的道德理解。本研究凸显了当前 PLM 在处理跨文化价值差异方面的局限性,强调了 developing culturally aware AI systems(更符合普遍人类价值观的 AI 系统)的重要性。
引用
@article{arxiv.2412.00956,
title = {Large Language Models as Mirrors of Societal Moral Standards},
author = {Evi Papadopoulou and Hadi Mohammadi and Ayoub Bagheri},
journal= {arXiv preprint arXiv:2412.00956},
year = {2024}
}