面向 AI 对齐的基础道德价值
计算机与社会
2023-11-29 v1 人工智能
摘要
解决 AI 对齐问题需要有清晰、可辩护的价值,使 AI 系统能够对齐。目前,对齐的目标仍不明确,且似乎并非建立在一个哲学上稳健的结构之上。我们通过提出五个核心的、基础性的价值来开启对此问题的讨论,这些价值源自道德哲学并建立在人类存在的必要条件之上:生存、可持续的代际存在、社会、教育以及真理。我们表明,这些价值不仅为技术对齐工作提供了更清晰的方向,而且作为一个框架,可用来凸显 AI 系统为获取和维持这些价值所带来的威胁与机遇。
引用
@article{arxiv.2311.17017,
title = {Foundational Moral Values for AI Alignment},
author = {Betty Li Hou and Brian Patrick Green},
journal= {arXiv preprint arXiv:2311.17017},
year = {2023}
}
备注
AI meets Moral Philosophy and Moral Psychology Workshop, 37th Conference on Neural Information Processing Systems (NeurIPS 2023)