BERT 具有道德指南针:机器伦理与道德价值的改进
计算与语言
2019-12-12 v1 人工智能
机器学习
机器学习
摘要
允许机器选择是否杀死人类将对世界和平与安全造成毁灭性打击。但我们如何赋予机器学习伦理乃至道德选择的能力?Jentzsch 等人(2019)表明,将机器学习应用于人类文本,可通过使用句子嵌入在句子层面计算道德偏差分数,提取关于“对”与“错”行为的道义论伦理推理。该机器学到:杀死生物是不可接受的,但消磨时间无妨;进食是必要的,但不应吃 dirt;传播信息很重要,但不应传播错误信息。然而,所评估的道德偏差仅限于简单动作——单一动词——以及带有上下文的动作排序。近来 BERT——及其变体如 RoBERTa 和 SBERT——为广泛的 NLP 任务设立了新的 SOTA 性能。但 BERT 是否也具有更好的道德指南针?本文讨论并表明事实确实如此。因此,语言表征的最新改进也改善了机器底层伦理与道德价值的表征。我们认为,通过先进的文本语义表征,BERT 能够更好地理解文本中隐式表征的道德与伦理价值。这使得道德选择机器(MCM)能够提取更精确的道德选择与伦理价值印记。
引用
@article{arxiv.1912.05238,
title = {BERT has a Moral Compass: Improvements of ethical and moral values of machines},
author = {Patrick Schramowski and Cigdem Turan and Sophie Jentzsch and Constantin Rothkopf and Kristian Kersting},
journal= {arXiv preprint arXiv:1912.05238},
year = {2019}
}