将国际象棋作为 AI 安全预言机方法的试验场
人工智能
2020-10-07 v1
摘要
为降低强大的超级智能 AI 带来的危险,我们可以让首批此类 AI 成为只能发送和接收消息的预言机(oracle)。本文提出了一种可能实用的方法,利用机器学习创建两类可提供国际象棋建议的狭义 AI 预言机:一类与棋手利益一致,另一类则希望棋手落败并给出具有欺骗性的糟糕建议。棋手将不确定自己正在与哪一类预言机交互。由于这些预言机在国际象棋领域远比棋手聪明,与它们的经验或许能帮助我们为未来的人工通用智能预言机做好准备。
引用
@article{arxiv.2010.02911,
title = {Chess as a Testing Grounds for the Oracle Approach to AI Safety},
author = {James D. Miller and Roman Yampolskiy and Olle Haggstrom and Stuart Armstrong},
journal= {arXiv preprint arXiv:2010.02911},
year = {2020}
}