一个用于评估高级 AI 社会尺度风险的国际联盟
计算机与社会
2023-11-07 v3 人工智能
摘要
鉴于迈向高级 AI 的快速进展以及来自前沿 AI 系统(推动 AI 能力前沿边界的高级 AI 系统)的风险,AI 治理与监管方案的制定和实施应优先并获得大量投资。然而,现状难以为继,且坦率地说危险。监管空白使得 AI 实验室得以在极少监督下进行研究、开发和部署活动。作为回应,前沿 AI 系统评估已被提出作为评估前沿 AI 系统开发与部署风险的一种方式。然而,新兴的 AI 风险评测生态系统面临显著的协调挑战,例如评估者多样性有限、努力分配次优以及扭曲的激励。本文提出一种以国际 AI 风险评测联盟为形式的解决方案,该联盟由 AI 开发者和第三方 AI 风险评测者共同组成。此类联盟可在国际社会缓解高级 AI 社会尺度风险的努力中发挥关键作用,包括管理负责任的扩展政策和基于协调评估的风险应对。在本文中,我们讨论当前的评测生态系统及其缺陷,提出一个高级 AI 风险评测国际联盟,讨论其实施相关问题,探讨可从以往国际机构及现有国际 AI 治理机构提案中吸取的教训,最后我们推荐推进拟议联盟建立的具体步骤:(i)征求利益相关者反馈,(ii)开展额外研究,(iii)为利益相关者举办研讨会,(iv)分析反馈并创建最终提案,(v)筹措资金,以及(vi)创建联盟。
引用
@article{arxiv.2310.14455,
title = {An International Consortium for Evaluations of Societal-Scale Risks from Advanced AI},
author = {Ross Gruetzemacher and Alan Chan and Kevin Frazier and Christy Manning and Štěpán Los and James Fox and José Hernández-Orallo and John Burden and Matija Franklin and Clíodhna Ní Ghuidhir and Mark Bailey and Daniel Eth and Toby Pilditch and Kyle Kilian},
journal= {arXiv preprint arXiv:2310.14455},
year = {2023}
}
备注
50 pages, 2 figures; updated w/ a few minor revisions based on feedback from SoLaR Workshop reviewers (on 5 page version)