中文

AI 对齐问题的多层次框架

计算机与社会 2023-01-11 v1 人工智能

摘要

AI 对齐考虑我们如何以与人类价值观相容的方式对 AI 系统进行编码。该问题的规范性一面追问:我们应当在 AI 中编码何种道德价值或原则(如果有的话)。为此,我们提出一个在四个层次——个体、组织、国家与全球——考量该问题的框架。我们旨在阐明 AI 对齐如何由每个层次上的价值对齐问题构成,其中各层次的价值相互影响,且效应可双向流动。我们概述了每个层次的关键问题与考量,并展示了该框架在 AI 内容审核主题上的一个应用。

关键词

引用

@article{arxiv.2301.03740,
  title  = {A Multi-Level Framework for the AI Alignment Problem},
  author = {Betty Li Hou and Brian Patrick Green},
  journal= {arXiv preprint arXiv:2301.03740},
  year   = {2023}
}

备注

ML Safety Workshop, 36th Conference on Neural Information Processing Systems (NeurIPS 2022)