中文

严肃对待原则:一种价值对齐的混合方法

人工智能 2020-12-23 v1 计算机与社会

摘要

在人工智能价值对齐(VA)系统的发展中,一个重要步骤是理解 VA 如何反映有效的伦理原则。我们建议 VA 系统的设计者通过采用一种混合方法来融入伦理学,其中伦理推理与经验观察均发挥作用。我们认为,这避免了犯下“自然主义谬误”——即试图从“是”推导出“应当”——并且在未犯此谬误时提供了更充分的伦理推理形式。利用量化模型逻辑,我们精确地表述了源自义务论伦理的原则,并展示了它们如何隐含地给出针对 AI 规则库中任何给定行动计划的具体“检验命题”。仅当该检验命题在经验上为真时,该行动计划才是合乎伦理的,这一判断基于经验性 VA 做出。这使得经验性 VA 能够与独立证成的伦理原则无缝整合。

关键词

引用

@article{arxiv.2012.11705,
  title  = {Taking Principles Seriously: A Hybrid Approach to Value Alignment},
  author = {Tae Wan Kim and John Hooker and Thomas Donaldson},
  journal= {arXiv preprint arXiv:2012.11705},
  year   = {2020}
}

备注

arXiv admin note: substantial text overlap with arXiv:1907.05447