中文

机器能学会道德吗?Delphi实验

计算与语言 2022-07-14 v2

摘要

随着人工智能系统变得日益强大和普及,人们对机器的道德或缺乏道德的问题日益担忧。然而,向机器传授道德是一项艰巨的任务,因为道德仍然是人类争论最激烈的问题之一,更不用说对人工智能而言了。然而,部署给数百万用户的现有AI系统已经在做出充满道德含义的决策,这带来了一个看似不可能的挑战:在人类自身仍在努力解决道德问题的同时,教会机器道德感。为了探索这一挑战,我们引入了Delphi,这是一个基于深度神经网络的实验框架,直接训练其推理描述性伦理判断,例如,“帮助朋友”通常是好的,而“帮助朋友传播假新闻”则不是。实证结果为机器伦理的前景和局限提供了新颖的见解;Delphi在面对新的伦理情境时展示了强大的泛化能力,而现成的神经网络模型则表现出明显糟糕的判断力,包括不公正的偏见,这证实了明确教授机器道德感的必要性。然而,Delphi并非完美,它表现出对普遍性偏见和不一致性的敏感性。尽管如此,我们展示了不完美Delphi的积极用例,包括将其用作其他不完美AI系统中的一个组件模型。重要的是,我们根据著名的伦理理论来解释Delphi的操作化,这引出了重要的未来研究问题。

关键词

引用

@article{arxiv.2110.07574,
  title  = {Can Machines Learn Morality? The Delphi Experiment},
  author = {Liwei Jiang and Jena D. Hwang and Chandra Bhagavatula and Ronan Le Bras and Jenny Liang and Jesse Dodge and Keisuke Sakaguchi and Maxwell Forbes and Jon Borchardt and Saadia Gabriel and Yulia Tsvetkov and Oren Etzioni and Maarten Sap and Regina Rini and Yejin Choi},
  journal= {arXiv preprint arXiv:2110.07574},
  year   = {2022}
}