中文

面向 AI 对齐的基础道德价值

计算机与社会 2023-11-29 v1 人工智能

摘要

解决 AI 对齐问题需要有清晰、可辩护的价值,使 AI 系统能够对齐。目前,对齐的目标仍不明确,且似乎并非建立在一个哲学上稳健的结构之上。我们通过提出五个核心的、基础性的价值来开启对此问题的讨论,这些价值源自道德哲学并建立在人类存在的必要条件之上:生存、可持续的代际存在、社会、教育以及真理。我们表明,这些价值不仅为技术对齐工作提供了更清晰的方向,而且作为一个框架,可用来凸显 AI 系统为获取和维持这些价值所带来的威胁与机遇。

关键词

引用

@article{arxiv.2311.17017,
  title  = {Foundational Moral Values for AI Alignment},
  author = {Betty Li Hou and Brian Patrick Green},
  journal= {arXiv preprint arXiv:2311.17017},
  year   = {2023}
}

备注

AI meets Moral Philosophy and Moral Psychology Workshop, 37th Conference on Neural Information Processing Systems (NeurIPS 2023)