中文

评估亚马逊 Nova Premier 在 Frontier Model Safety Framework 下的关键风险

密码学与安全 2025-07-10 v1 计算机与社会

摘要

Nova Premier 是亚马逊最强大的多模态基础模型,也是模型蒸馏的教师模型。它能够处理文本、图像和视频,并具备百万 token 的上下文窗口,使其能够在单个提示中分析大型代码库、400 页文档和 90 分钟的视频。我们在 Frontier Model Safety Framework 下,对 Nova Premier 的关键风险概貌进行了首次全面评估。评估目标聚焦三个高风险领域——化学、生物学、放射性与核(CBRN)、军事网络作战以及自动化 AI 研发——并结合自动化基准测试、专家红队攻击和提升研究,以确定该模型是否超过发布阈值。我们总结了方法论并报告核心发现。根据本次评估,我们发现 Nova Premier 符合在 2025 年巴黎 AI 安全峰会上所作出的承诺,适合公开发布。我们将继续完善安全评估和缓解管道,以应对随着前沿模型新风险和新能力识别而产生的挑战。

关键词

引用

@article{arxiv.2507.06260,
  title  = {Evaluating the Critical Risks of Amazon's Nova Premier under the Frontier Model Safety Framework},
  author = {Satyapriya Krishna and Ninareh Mehrabi and Abhinav Mohanty and Matteo Memelli and Vincent Ponzo and Payal Motwani and Rahul Gupta},
  journal= {arXiv preprint arXiv:2507.06260},
  year   = {2025}
}