AI 对齐问题的多层次框架
计算机与社会
2023-01-11 v1 人工智能
摘要
AI 对齐考虑我们如何以与人类价值观相容的方式对 AI 系统进行编码。该问题的规范性一面追问:我们应当在 AI 中编码何种道德价值或原则(如果有的话)。为此,我们提出一个在四个层次——个体、组织、国家与全球——考量该问题的框架。我们旨在阐明 AI 对齐如何由每个层次上的价值对齐问题构成,其中各层次的价值相互影响,且效应可双向流动。我们概述了每个层次的关键问题与考量,并展示了该框架在 AI 内容审核主题上的一个应用。
引用
@article{arxiv.2301.03740,
title = {A Multi-Level Framework for the AI Alignment Problem},
author = {Betty Li Hou and Brian Patrick Green},
journal= {arXiv preprint arXiv:2301.03740},
year = {2023}
}
备注
ML Safety Workshop, 36th Conference on Neural Information Processing Systems (NeurIPS 2022)