中文

大型语言模型的道德差距

计算与语言 2025-07-25 v1 计算机与社会 人机交互 机器学习

摘要

道德基础检测对于分析社会话语和开发符合伦理准则的AI系统至关重要。虽然大型语言模型在各种任务中表现出色,但其在专门道德推理任务上的表现尚不明确。本研究提供了首次将最先进的LLMs与微调变形器进行综合比较的分析,使用ROC、PR和DET曲线。结果揭示了显著的性能差距,LLMs表现出高假阴性率和系统性低估道德内容,尽管进行了提示工程。这些发现表明,针对道德推理应用,任务特定的微调仍然优于提示方法。

关键词

引用

@article{arxiv.2507.18523,
  title  = {The Moral Gap of Large Language Models},
  author = {Maciej Skorski and Alina Landowska},
  journal= {arXiv preprint arXiv:2507.18523},
  year   = {2025}
}

备注

preprint