中文

前沿AI的安全论证

计算机与社会 2024-10-30 v1

摘要

随着前沿人工智能(AI)系统日益强大,开发者能够解释其系统为何足够安全变得愈发重要。一种实现方式是通过安全论证(safety cases):即在特定运行环境下,通过证据支持的结构化论证来说明系统足够安全的报告。安全论证在航空和核电等其他安全关键型行业中已很常见。在本文中,我们解释了为何安全论证在前沿AI治理中也可能是一种有用的工具,无论在行业自律还是政府监管中均如此。随后,我们讨论了安全论证的实践细节,概述了如何撰写前沿AI的安全论证,并探讨了在安全论证能够实质性辅助决策之前仍需开展的工作。

关键词

引用

@article{arxiv.2410.21572,
  title  = {Safety cases for frontier AI},
  author = {Marie Davidsen Buhl and Gaurav Sett and Leonie Koessler and Jonas Schuett and Markus Anderljung},
  journal= {arXiv preprint arXiv:2410.21572},
  year   = {2024}
}

备注

25 pages, 6 figures, 5 tables