Certified Safe:面向前沿人工智能的批准监管方案
计算机与社会
2024-08-13 v1
摘要
近期不断进展的能力提升伴随着对前沿人工智能(AI)进行全面而非零散监管的呼声。批准监管正成为一种有前景的候选方案。批准监管方案指的是企业在未经监管机构基于产品实验表明其安全性前提下,无法合法地市场甚至开发产品的监管框架。这种方法已被成功应用于美国FDA和FAA。此外,许多突出利益相关方公开支持将其应用于前沿AI。本报告提出仅针对最大AI项目的批准监管方案,监管从训练前开始,持续到部署后监控。该方案的两个主要批准门槛是:第一个要求获得大规模训练的批准,第二个要求获得部署的批准。五个主要挑战使其实施难以实现:通过未经授权的部署实现不合规、部署准备要求的规定、可靠的模型实验、在过程中筛选出安全模型以及最小化监管开销。本报告提出了若干关键性建议以提高批准监管的可行性,其中一些建议如果不在近期就实现,此类监管体系将难以成功。进一步的建议得自本报告的分析,有助于提高任何针对前沿AI监管体系的有效性。
引用
@article{arxiv.2408.06210,
title = {Certified Safe: A Schematic for Approval Regulation of Frontier AI},
author = {Cole Salvador},
journal= {arXiv preprint arXiv:2408.06210},
year = {2024}
}