AI价值对齐中伦理效用函数的必要多样性
人工智能
2019-07-02 v1
摘要
作为AI安全研究中重要且复杂的课题,价值对齐近年来已从多个视角被研究。然而,关于促进AI价值对齐的伦理效用函数设计,尚未达成最终共识。鉴于识别系统性解决方案的紧迫性,我们假定从简单事实出发或许有益:要使AI的效用函数不违背人类伦理直觉,它显然必须是这些直觉的模型并反映其多样性——其中关于作为具备构造诸如道德判断等概念的大脑之生物有机体的人类实体,最精确的模型是科学模型。因此,为更好地评估人类道德的多样性,我们运用安全思维对该问题进行跨学科分析,并总结来自神经科学与心理学的多样性相关背景知识。我们通过将其与作为合适伦理框架的增强功利主义相联系来补充该信息。基于此,我们提出用于设计能更好捕捉人类道德判断多样性的近似伦理目标函数的首批实践指南。最后,我们得出结论并探讨未来可能的挑战。
引用
@article{arxiv.1907.00430,
title = {Requisite Variety in Ethical Utility Functions for AI Value Alignment},
author = {Nadisha-Marie Aliman and Leon Kester},
journal= {arXiv preprint arXiv:1907.00430},
year = {2019}
}
备注
IJCAI 2019 AI Safety Workshop