中文

AI忠诚:一种对齐利益相关者利益的新范式

计算机与社会 2020-03-26 v1

摘要

当我们咨询医生、律师或财务顾问时,我们通常假定他们是在我们的最佳利益下行事。但是,当代表我们行事的是一个人工智能(AI)系统时,我们应该作何假定?像Alexa、Siri、Google和Cortana这样的早期AI助手例子已经作为消费者与网络信息之间的关键接口,用户 routinely 依赖此类AI驱动系统来执行自动化操作或提供信息。表面上,此类系统似乎是按照用户利益行事的。然而,许多AI系统被设计为嵌入利益冲突,以微妙地有益于其创造者(或资助者)而损害用户的方式行事。为解决此问题,本文引入AI忠诚的概念。AI系统的忠诚程度在于其被设计为使利益冲突最小化并透明化,且以优先用户利益的方式行事。经过恰当设计,此类系统相对于那些没有这样设计的系统可能具有相当的功能性和竞争性——更不用说伦理上的——优势。忠诚的AI产品对终端用户具有显而易见的吸引力,并有助于促进AI开发者和客户长期利益的对齐。为此,我们提出用于评估一个AI系统是否充分透明地披露利益冲突并以忠诚于用户的方式行事的标准,并主张在技术设计过程中应同公平性、问责制、隐私和公平等其他AI伦理重要价值一起考虑AI忠诚。我们讨论了一系列机制,从纯粹的市场力量到强有力的监管框架,可以支持将AI忠诚纳入各种未来AI系统中。

关键词

引用

@article{arxiv.2003.11157,
  title  = {AI loyalty: A New Paradigm for Aligning Stakeholder Interests},
  author = {Anthony Aguirre and Gaia Dempsey and Harry Surden and Peter B. Reiner},
  journal= {arXiv preprint arXiv:2003.11157},
  year   = {2020}
}