个人宇宙:多智能体价值对齐问题的一种解决方案
人工智能
2019-01-08 v1
摘要
试图将高能力智能系统价值与人类社会价值对齐的 AI 安全研究者面临诸多挑战,包括个人价值提取、多智能体价值合并以及最终的硅基编码。价值对齐的最先进研究显示该过程每个阶段都存在困难,但不兼容偏好的合并是尤其难以克服的挑战。本文中我们假设价值提取问题将被解决,并提出一种可能的方式来实现与每个用户的个人偏好最优对齐的 AI 方案。最后我们通过分析所提方法的益处与局限作结。
引用
@article{arxiv.1901.01851,
title = {Personal Universes: A Solution to the Multi-Agent Value Alignment Problem},
author = {Roman V. Yampolskiy},
journal= {arXiv preprint arXiv:1901.01851},
year = {2019}
}