中文

验证 AI 国际协议:关于大规模 AI 发展与部署规则的六层验证

计算机与社会 2025-07-29 v2

摘要

前沿 AI 的风险可能需要国际合作,而这反过来又需要验证:检查所有各方是否遵守既定规则。例如,各国可能需要验证强大 AI 模型是否仅在其对国际安全构成风险后被评估且风险可控后才被广泛部署。然而,AI 验证的研究可能受益于更大的清晰度和细节。为此,本报告为政策专业人士和技术研究人员提供了深入概述,提出了新的概念框架、详细的实施选项和关键研发挑战。这些内容源自现有文献、专家访谈和原创分析,均纳入对使用大量高端 AI 芯片进行的 AI 开发和部署的保密监督范围内。我们发现,各国最终可通过使用六种大体上独立的验证方法并具有 substantial 冗余来验证合规性:(1)AI 芯片内置的安全功能;(2-3)附加到 AI 芯片的独立监控设备;(4-6)基于人员的机制,如举报人计划。尽管这些方法前景光明,但需要措施以防止滥用和权力集中,而许多技术尚未构建或进行压力测试。为使各国能够自信地验证大规模 AI 发展和部署规则的合规性,我们所列出的研发挑战需要取得显著进展。

关键词

引用

@article{arxiv.2507.15916,
  title  = {Verifying International Agreements on AI: Six Layers of Verification for Rules on Large-Scale AI Development and Deployment},
  author = {Mauricio Baker and Gabriel Kulp and Oliver Marks and Miles Brundage and Lennart Heim},
  journal= {arXiv preprint arXiv:2507.15916},
  year   = {2025}
}

备注

80 pages, summary included