中文

论以负责任方式构建AI的伦理

机器学习 2020-04-10 v1

摘要

当人类设计者指定给AI学习器的目标与未反映人类设计者真实意图的潜在灾难性结果之间存在差异时,便出现AI对齐问题。我们认为,若不区分策略性错位与不可知错位,AI对齐的形式化是无用的,因为它将所有技术都视为不安全。我们提出策略性AI对齐的定义,并证明当今实践中使用的多数机器学习算法不存在策略性AI对齐问题。然而,若不谨慎,当今技术可能导致策略性错位。

关键词

引用

@article{arxiv.2004.04644,
  title  = {On the Ethics of Building AI in a Responsible Manner},
  author = {Shai Shalev-Shwartz and Shaked Shammah and Amnon Shashua},
  journal= {arXiv preprint arXiv:2004.04644},
  year   = {2020}
}