价值对齐、公平博弈与服务机器人的权利
计算机与社会
2018-12-07 v1 人工智能
摘要
人工智能中的伦理与安全研究日益以与人类价值和利益“对齐”为框架。我认为图灵对“机器的公平博弈”的呼吁是对齐文献中早期且常被忽视的贡献。图灵对公平博弈的诉求暗示需要纠正人类行为以容纳我们的机器,这与当今处理价值对齐的方式形成惊人反转。对“公平博弈”的反思促成了对图灵臭名昭著的“模仿游戏”的新诠释:它并非智能的条件,而是价值对齐的条件——当机器在接受人类审问时未被察觉,便展示出(例如与对话规范)最小程度的对齐。我仔细将此诠释与道德图灵测试区分开,后者并非由公平博弈原则驱动,而是依赖于对人类道德行为的模仿。最后,我思考公平博弈框架如何用于将机器人权利之争置于对齐文献中。我认为,向在公共空间运行的服务机器人延伸权利是“公平”的,恰因其鼓励人与机器间利益的对齐。
引用
@article{arxiv.1803.02852,
title = {Value Alignment, Fair Play, and the Rights of Service Robots},
author = {Daniel Estrada},
journal= {arXiv preprint arXiv:1803.02852},
year = {2018}
}