中文

前沿AI安全框架的新兴实践

计算机与社会 2025-03-10 v1 人工智能

摘要

作为2024年AI首尔峰会达成的《前沿AI安全承诺》的一部分,许多AI开发者同意发布一份安全框架,说明他们将如何管理其系统可能带来的严重风险。本文总结了来自企业、政府和研究人员的关于如何编写有效安全框架的当前思考。本文概述了安全框架的三个核心领域——风险识别与评估、风险缓解和治理——并识别了每个领域的新兴实践。由于安全框架尚属新颖且发展迅速,本文希望既能作为截至目前工作的概述,也能作为进一步讨论和创新的起点。

关键词

引用

@article{arxiv.2503.04746,
  title  = {Emerging Practices in Frontier AI Safety Frameworks},
  author = {Marie Davidsen Buhl and Ben Bucknall and Tammy Masterson},
  journal= {arXiv preprint arXiv:2503.04746},
  year   = {2025}
}

备注

38 pages