睁大双眼:警惕性激励助力监管市场改善 AI 安全
人工智能
2023-03-07 v1 计算机与社会
计算机科学与博弈论
多智能体系统
综合经济学
经济学
摘要
在 AI 领域领先者快速取得突破的背景下,政府必须考虑如何设计能够匹配新 AI 能力涌现速度的监管。AI 监管市场是一项以适应性为出发点的提案,其内容是政府为 AI 公司设定基于结果的指标,AI 公司可通过从私营监管者市场购买服务来达成这些指标。我们使用演化博弈论模型,探讨政府在构建能够遏制鲁莽行为的 AI 系统监管市场中可发挥的作用。我们警示,轻易陷入某些会阻碍监管市场实现该目标的激励结构令人担忧。这类“赏金激励”仅在对不安全行为实施抓捕时奖励私营监管者。我们认为,AI 公司很可能学会根据监管者投入的努力程度来调整自身行为,从而抑制监管者的创新。相反,我们建议政府始终奖励监管者,除非发现这些监管者未能检测出本应发现的不安全行为。这类“警惕性激励”可鼓励私营监管者寻找评估前沿 AI 系统的创新方法。
引用
@article{arxiv.2303.03174,
title = {Both eyes open: Vigilant Incentives help Regulatory Markets improve AI Safety},
author = {Paolo Bova and Alessandro Di Stefano and The Anh Han},
journal= {arXiv preprint arXiv:2303.03174},
year = {2023}
}