两类 AI 生存性风险:决断性与累积性
计算机与社会
2025-01-20 v3 人工智能
机器学习
摘要
关于 AI 生存性风险 (x-risks) 的传统论述通常聚焦于由先进 AI 系统(尤其是那些可能达到或超越人类智能水平的系统)引发的突发性、灾难性事件。这些事件具有严重后果,要么导致人类灭绝,要么不可逆转地将人类文明削弱到无法恢复的地步。然而,这种论述常常忽略了 AI 生存性风险通过一系列较小但相互关联的破坏逐步显现,随时间逐渐越过关键阈值的严重可能性。本文将传统的“决断性 AI 生存性风险假说”与“累积性 AI 生存性风险假说”进行对比。前者设想了一种公开的 AI 接管路径,以不可控的超级智能等场景为特征;后者则指出了通往生存性灾难的另一条因果路径。这涉及 AI 引发的关键威胁(如严重脆弱性以及经济和政治结构的系统性侵蚀)的逐渐累积。累积性假说暗示了一种温水煮青蛙的情景:渐增的 AI 风险缓慢汇聚,削弱社会韧性,直至一个触发事件导致不可逆转的崩溃。通过系统分析,本文审视了区分这两种假说的不同假设。随后论证了累积性观点可以调和看似不相容的 AI 风险观点。本文讨论了区分这两种因果路径——决断性与累积性——对 AI 治理以及长期 AI 安全的影响。
引用
@article{arxiv.2401.07836,
title = {Two Types of AI Existential Risk: Decisive and Accumulative},
author = {Atoosa Kasirzadeh},
journal= {arXiv preprint arXiv:2401.07836},
year = {2025}
}
备注
Journal article for Philosophical Studies