通用人工智能(GPAI)与基础模型的人工智能风险管理标准概览
人工智能
2025-07-01 v1 密码学与安全
计算机与社会
摘要
日益多用途的人工智能模型,如最前沿的大型语言模型或其他'通用人工智能'(GPAI)模型、'基础模型'、生成式人工智能模型和'前沿模型'(通常在此处统一称为'GPAI/基础模型',除非需要更具体的表述),可以提供许多有益的功能,但也可能带来深远后果的不良事件风险。本文件提供了用于识别、分析和缓解GPAI/基础模型风险的风险管理实践或控制措施。我们主要面向开发大型规模、最前沿GPAI/基础模型的开发者;其他包括那些从事以GPAI/基础模型为基础开发最终应用的下游开发者。这一文件促进了符合或使用主要人工智能风险管理相关标准的实践,借鉴并扩展了NIST人工智能风险管理框架和ISO/IEC 23894中关于通用自愿性指导方针,特别关注GPAI/基础模型开发者所面临的独特问题。
引用
@article{arxiv.2506.23949,
title = {AI Risk-Management Standards Profile for General-Purpose AI (GPAI) and Foundation Models},
author = {Anthony M. Barrett and Jessica Newman and Brandie Nonnecke and Nada Madkour and Dan Hendrycks and Evan R. Murphy and Krystal Jackson and Deepika Raman},
journal= {arXiv preprint arXiv:2506.23949},
year = {2025}
}