中文

规则本该被破坏吗?基于 UniMoral 的多语言道德推理理解

计算与语言 2025-02-21 v1

摘要

道德推理是由个人经历和文化背景塑造的复杂认知过程,对计算分析具有独特挑战。虽然自然语言处理 (NLP) 为研究这一现象提供了有前景的工具,但当前研究缺乏一致性,采用不一致的数据集和任务,仅探讨道德推理的孤立方面。我们通过 UniMoral 弥合了这一差距,该统一数据集整合了心理学基础且源自社交媒体的道德困境,标注包括行动选择、伦理原则、贡献因素和后果,以及标注者的道德和文化轮廓。鉴于道德推理的文化相对性,UniMoral 覆盖六种语言(阿拉伯语、中文、英文、印地语、俄语和西班牙语),捕捉多样化的社会文化语境。我们通过对三大语言模型在四项任务上的基准评估展示了 UniMoral 的实用性:行动预测、道德类型分类、因素归因分析和后果生成。关键发现表明,虽然隐式嵌入的道德背景增强了语言模型的道德推理能力,但仍需更专业的方法来进一步推进这些模型的道德推理。

关键词

引用

@article{arxiv.2502.14083,
  title  = {Are Rules Meant to be Broken? Understanding Multilingual Moral Reasoning as a Computational Pipeline with UniMoral},
  author = {Shivani Kumar and David Jurgens},
  journal= {arXiv preprint arXiv:2502.14083},
  year   = {2025}
}

备注

21 pages, 10 figures, 8 tables