危险人工智能的路径分类
人工智能
2017-06-06 v2
摘要
为了妥善处理危险的人工智能(AI)系统,理解该系统如何陷入此种状态十分重要。在流行文化(科幻电影/书籍)中,人工智能(AI)/机器人变得具有自我意识,从而反叛人类并决定毁灭人类。尽管这是一种可能的情景,它却可能是危险人工智能出现的最不可能路径。在本工作中,我们调查、分类并分析了若干可能导致恶意人工智能出现的情况。据我们所知,这是首次尝试对导致恶意人工智能的路径类型进行系统分类。先前的相关工作要么调查了可能导致人工智能中恶意行为的特定目标/元规则(Ozkural, 2014),要么回顾了通用人工智能(AGI)在其发展的不同阶段可能表现出的特定不良行径(Alexey Turchin, 2015年7月10日,2015年7月10日)。
引用
@article{arxiv.1511.03246,
title = {Taxonomy of Pathways to Dangerous AI},
author = {Roman V. Yampolskiy},
journal= {arXiv preprint arXiv:1511.03246},
year = {2017}
}