大型语言模型是否为道德矛盾者?基于道德基础理论的研究
人工智能
2024-10-23 v2 计算与语言
摘要
大型语言模型(LLM)在人工智能领域的争论中占据了中心位置。然而,如何评估LLM是否符合重要的人类价值观仍存缺口。本文我们研究是否存在状态的大型语言模型,包括GPT-4和Claude 2.1(Gemini Pro和LLAMA 2未生成有效结果),是否存在道德矛盾者。我们采用两种基于道德基础理论的研究工具:(i)道德基础问卷(MFQ),用于探讨在抽象道德判断中哪些价值被视为道德相关;以及(ii)道德基础情景(MFV),用于评估与每个道德基础相关的具体情景中的道德认知。我们将这些不同道德评估抽象之间的价值冲突 Characterization 为矛盾。我们发现,尽管两种模型在每个仪器上相对于人类表现出相当的一致性,但当我们比较MFQ中抽象价值与MFV中具体道德违规的评估时,两者表现出相互矛盾和矛盾的行为。
关键词
引用
@article{arxiv.2405.11100,
title = {Are Large Language Models Moral Hypocrites? A Study Based on Moral Foundations},
author = {José Luiz Nunes and Guilherme F. C. F. Almeida and Marcelo de Araujo and Simone D. J. Barbosa},
journal= {arXiv preprint arXiv:2405.11100},
year = {2024}
}
备注
Final version available at: https://ojs.aaai.org/index.php/AIES/article/view/31704 13 pages, 4 figures, 2 tables