前沿AI安全框架的新兴实践
计算机与社会
2025-03-10 v1 人工智能
摘要
作为2024年AI首尔峰会达成的《前沿AI安全承诺》的一部分,许多AI开发者同意发布一份安全框架,说明他们将如何管理其系统可能带来的严重风险。本文总结了来自企业、政府和研究人员的关于如何编写有效安全框架的当前思考。本文概述了安全框架的三个核心领域——风险识别与评估、风险缓解和治理——并识别了每个领域的新兴实践。由于安全框架尚属新颖且发展迅速,本文希望既能作为截至目前工作的概述,也能作为进一步讨论和创新的起点。
引用
@article{arxiv.2503.04746,
title = {Emerging Practices in Frontier AI Safety Frameworks},
author = {Marie Davidsen Buhl and Ben Bucknall and Tammy Masterson},
journal= {arXiv preprint arXiv:2503.04746},
year = {2025}
}
备注
38 pages