从算法黑箱到自适应白箱:作为伦理准则的声明式决策理论伦理程序
人工智能
2017-11-17 v1
摘要
算法伦理是社会科学、法学、哲学以及人工智能(AI)等多学科的新兴话题。价值对齐问题表达了(机器)学习以某种方式与人类需求或价值对齐的价值的挑战。在本文中,我主张审视人类如何在专业伦理准则中形式化并交流价值,并探索使用声明式决策理论伦理程序(DDTEP)来形式化伦理准则。这使得机器伦理推理与决策以及学习更加透明,并有望更可问责。本文包含了已知玩具困境以及诸如档案与图书馆等把关领域的定义性概念验证示例。
引用
@article{arxiv.1711.06035,
title = {From Algorithmic Black Boxes to Adaptive White Boxes: Declarative Decision-Theoretic Ethical Programs as Codes of Ethics},
author = {Martijn van Otterlo},
journal= {arXiv preprint arXiv:1711.06035},
year = {2017}
}
备注
7 pages, 1 figure, submitted