中文

通用人工智能(GPAI)与基础模型的人工智能风险管理标准概览

人工智能 2025-07-01 v1 密码学与安全 计算机与社会

摘要

日益多用途的人工智能模型,如最前沿的大型语言模型或其他'通用人工智能'(GPAI)模型、'基础模型'、生成式人工智能模型和'前沿模型'(通常在此处统一称为'GPAI/基础模型',除非需要更具体的表述),可以提供许多有益的功能,但也可能带来深远后果的不良事件风险。本文件提供了用于识别、分析和缓解GPAI/基础模型风险的风险管理实践或控制措施。我们主要面向开发大型规模、最前沿GPAI/基础模型的开发者;其他包括那些从事以GPAI/基础模型为基础开发最终应用的下游开发者。这一文件促进了符合或使用主要人工智能风险管理相关标准的实践,借鉴并扩展了NIST人工智能风险管理框架和ISO/IEC 23894中关于通用自愿性指导方针,特别关注GPAI/基础模型开发者所面临的独特问题。

关键词

引用

@article{arxiv.2506.23949,
  title  = {AI Risk-Management Standards Profile for General-Purpose AI (GPAI) and Foundation Models},
  author = {Anthony M. Barrett and Jessica Newman and Brandie Nonnecke and Nada Madkour and Dan Hendrycks and Evan R. Murphy and Krystal Jackson and Deepika Raman},
  journal= {arXiv preprint arXiv:2506.23949},
  year   = {2025}
}