中文

睁大双眼:警惕性激励助力监管市场改善 AI 安全

人工智能 2023-03-07 v1 计算机与社会 计算机科学与博弈论 多智能体系统 综合经济学 经济学

摘要

在 AI 领域领先者快速取得突破的背景下,政府必须考虑如何设计能够匹配新 AI 能力涌现速度的监管。AI 监管市场是一项以适应性为出发点的提案,其内容是政府为 AI 公司设定基于结果的指标,AI 公司可通过从私营监管者市场购买服务来达成这些指标。我们使用演化博弈论模型,探讨政府在构建能够遏制鲁莽行为的 AI 系统监管市场中可发挥的作用。我们警示,轻易陷入某些会阻碍监管市场实现该目标的激励结构令人担忧。这类“赏金激励”仅在对不安全行为实施抓捕时奖励私营监管者。我们认为,AI 公司很可能学会根据监管者投入的努力程度来调整自身行为,从而抑制监管者的创新。相反,我们建议政府始终奖励监管者,除非发现这些监管者未能检测出本应发现的不安全行为。这类“警惕性激励”可鼓励私营监管者寻找评估前沿 AI 系统的创新方法。

关键词

引用

@article{arxiv.2303.03174,
  title  = {Both eyes open: Vigilant Incentives help Regulatory Markets improve AI Safety},
  author = {Paolo Bova and Alessandro Di Stefano and The Anh Han},
  journal= {arXiv preprint arXiv:2303.03174},
  year   = {2023}
}