用于评估前沿AI模型的生物威胁基准生成框架III:细菌生物威胁基准(B3)数据集的实施
机器学习
2025-12-10 v1 人工智能
计算机与社会
新兴技术
摘要
快速发展的前沿人工智能(AI)模型,特别是大型语言模型(LLM),可能助长生物恐怖主义或获取生物武器的潜力,已引发重大的政策、学术和公众关注。模型开发者和政策制定者都寻求量化和缓解任何风险,此类努力的一个重要组成部分是开发能够评估特定模型所构成的生物安全风险的模型基准。本文讨论了细菌生物威胁基准(B3)数据集的试点实施。这是描述整体生物威胁基准生成(BBG)框架的三篇系列论文中的第三篇,前两篇论文详细介绍了B3数据集的开发。试点工作包括通过一个样本前沿AI模型运行基准,随后对模型响应进行人工评估,并从多个维度对结果进行应用风险分析。总体而言,试点表明B3数据集提供了一种可行且细致的方法,用于快速评估LLM所构成的生物安全风险,识别该风险的关键来源,并为优先缓解领域提供指导。
引用
@article{arxiv.2512.08459,
title = {Biothreat Benchmark Generation Framework for Evaluating Frontier AI Models III: Implementing the Bacterial Biothreat Benchmark (B3) Dataset},
author = {Gary Ackerman and Theodore Wilson and Zachary Kallenborn and Olivia Shoemaker and Anna Wetzel and Hayley Peterson and Abigail Danfora and Jenna LaTourette and Brandon Behlendorf and Douglas Clifford},
journal= {arXiv preprint arXiv:2512.08459},
year = {2025}
}
备注
19 pages, 2 figures