玻璃盒治理:为 AI 行为实施透明的道德边界
其他计算机科学
2019-06-12 v2 人工智能
计算机与社会
摘要
人工智能(AI)应用正被用于预测和评估多个领域中的行为,如刑事司法与消费金融,这些直接影响人类福祉。然而,若 AI 要改善人们生活,则人们必须能够信任 AI,这意味着能够理解系统在做什么以及为何这样做。尽管透明度常被视为此情形下的要求,但现实地看它未必总是可能或可取,而确保系统在既定道德边界内运行的需求依然存在。本文中,我们提出一种基于监测 AI 系统输入输出以评估其道德边界的方法。我们通过将道德价值映射为约束输入与输出的显式可验证规范,在系统周围放置一个“玻璃盒”,使得若这些输入输出始终留在盒内,我们便能保证系统遵从该价值。对输入输出的关注使得对差异巨大的智能系统(从深度神经网络到基于智能体的系统)的验证与比较成为可能。将抽象道德价值显式转化为具体规范,在可解释性方面带来巨大益处;利益相关者确切知晓系统如何解释并运用相关抽象人类道德价值,并相应校准其信任。此外,通过在更高层次运作,我们可检查系统对同一价值不同解释下的合规性。这些优势将对广大 AI 系统用户的福祉产生影响,建立其信任并提供关于系统如何遵从道德价值的具体知识。
引用
@article{arxiv.1905.04994,
title = {Governance by Glass-Box: Implementing Transparent Moral Bounds for AI Behaviour},
author = {Andrea Aler Tubella and Andreas Theodorou and Virginia Dignum and Frank Dignum},
journal= {arXiv preprint arXiv:1905.04994},
year = {2019}
}
备注
7 pages, 2 figures, conference paper