中文

道德对齐之上的伦理推理:LLM 中上下文伦理策略的一个案例与框架

计算与语言 2023-10-12 v1 人工智能

摘要

在本立场论文中,我们主张不应将 LLM 道德对齐到特定的伦理原则集合,而应向其注入通用的伦理推理能力,以使它们能在全球尺度上处理价值多元性。当给定一项伦理策略时,LLM 应能够做出与该策略伦理一致的决定。我们开发了一个框架,将道德困境与关乎不同规范伦理学形式及不同抽象层次的道德原则相整合。使用 GPT-x 模型的初步实验表明,尽管 GPT-4 近乎完美的伦理推理者,这些模型仍对西方及英语社会的道德价值存在偏向。

关键词

引用

@article{arxiv.2310.07251,
  title  = {Ethical Reasoning over Moral Alignment: A Case and Framework for In-Context Ethical Policies in LLMs},
  author = {Abhinav Rao and Aditi Khandelwal and Kumar Tanmay and Utkarsh Agarwal and Monojit Choudhury},
  journal= {arXiv preprint arXiv:2310.07251},
  year   = {2023}
}