中文

有益人工智能的规范:社会价值对齐问题的计算分析

计算机与社会 2020-12-23 v2 人工智能

摘要

基于人工智能(A.I.)的系统的兴起已经为整个社会带来实质性益处。然而,这些系统也可能蕴含潜在冲突与意外后果。值得注意的是,若某 A.I. 系统赋予使用者优势,人们往往会采用它,此时若使用者的优势以非使用者的代价为成本,非使用者可能会推动强监管。在此我们提出一个基于智能体的博弈论模型来描述这些冲突,其中智能体可决定借助 A.I. 来获取关于随机博弈收益额的额外信息,力求从模拟出发为迄今主要属哲学层面的讨论提供洞见。我们将结果置于当前关于伦理 A.I. 及个体与社会收益间冲突——即社会价值对齐问题——的讨论框架下。我们在人工智能体遵循的不同规范下检验 A.I. 技术采纳中出现的均衡、其随之而来的收益,以及涌现的财富不平等水平。我们表明,若无任何监管,纯粹自私的 A.I. 系统将具有最强优势,即便功利主义 A.I. 为个体与社会提供了显著益处。然而,我们表明可以开发遵循人类自觉策略的 A.I. 系统,当其引入社会时,会导向一种均衡:使用者的收益不以非使用者的代价为成本,从而提升人口总体财富并降低不平等。但如所示,此类策略的自组织采纳需要外部监管。

关键词

引用

@article{arxiv.1907.03843,
  title  = {Norms for Beneficial A.I.: A Computational Analysis of the Societal Value Alignment Problem},
  author = {Pedro Fernandes and Francisco C. Santos and Manuel Lopes},
  journal= {arXiv preprint arXiv:1907.03843},
  year   = {2020}
}