道德、机器与解释问题:一种基于价值、维特根斯坦式的道德主体构建路径
人工智能
2023-02-08 v4 计算与语言
计算机与社会
摘要
我们提出所谓解释问题,即任何符号形式的规则都可能以我们或许不认可的无限多种方式被解释,并论证任何将道德内置入机器的尝试都受制于该问题。我们表明人工智能中的解释问题是维特根斯坦一般主张(即任何规则都无法包含其自身应用的标准)的一个例证,且此问题所引发的风险随机器与世界因果关联的程度而按比例升级,我们称之为解释暴露定律。借助博弈论,我们试图界定规范空间的结构,并论证规范空间内的任何规则遵循都由该空间之外且自身无法被表示为规则的价值所引导。有鉴于此,我们将人工道德主体可能犯的错误归类为意图错误与工具错误,并提出了通过将道德内置入机器的方式来使其按照这些外部价值解释我们所给规则,途径包括显式道德推理、示而不告范式、主体因果能力与结构的调整,以及关系价值,最终目标是使机器养成美德品格并最小化解释问题的影响。
引用
@article{arxiv.2103.02728,
title = {Morality, Machines and the Interpretation Problem: A Value-based, Wittgensteinian Approach to Building Moral Agents},
author = {Cosmin Badea and Gregory Artus},
journal= {arXiv preprint arXiv:2103.02728},
year = {2023}
}