面向前沿人工智能的风险阈值
计算机与社会
2024-06-24 v1
摘要
前沿人工智能(AI)系统可能对公共安全和安全性构成日益增加的风险。但到底接受什么样的风险水平呢?一种日益流行的做法是定义能力阈值,这些阈值描述超过这些阈值的 AI 能力将被视为风险过大。更直接的做法是定义风险阈值,直接说明风险水平到什么程度才算过大。例如,他们可能声明:网络犯罪分子利用 AI 系统造成 X 金额度的经济损失的概率不能增加超过 Y 百分比点。风险阈值的主要优势在于比能力阈值更具原则性,但主要劣势在于可靠评估更为困难。因此,我们目前建议公司(1)定义风险阈值,以提供原则性决策基础;(2)利用这些风险阈值帮助设定能力阈值;(3)主要依赖能力阈值进行决策。监管机构也应探索这一领域,因为最终,他们是定义风险阈值最合法的行动者。如果 AI 风险估计变得更可靠,风险阈值应在决策中发挥越来越直接的作用。
引用
@article{arxiv.2406.14713,
title = {Risk thresholds for frontier AI},
author = {Leonie Koessler and Jonas Schuett and Markus Anderljung},
journal= {arXiv preprint arXiv:2406.14713},
year = {2024}
}
备注
24 pages, 6 figures, 1 table