中文

理解AI安全研究所的第一波:特征、功能与挑战

计算机与社会 2024-10-15 v1

摘要

2023年11月,英国和美国宣布成立AI安全研究所(AISIs)。随后,五个其他司法辖区率先建立AISIs或类似机构,更多地区也可能随之跟进。尽管这些机构之间存在显著差异,但也存在一些值得识别的关键相似性。本 primer 描述了一类类似的AISIs,即“第一波”AISIs,包括日本、英国和美国AISIs。第一波AISIs具有若干基本共同特征:它们是技术性政府机构,拥有明确的与先进AI系统安全有关的授权,且缺乏监管权力。安全评估是第一波AISIs的核心工作。这些技术测试AI系统在相关风险(如网络安全、化学和生物滥用)上的行为和能力。它们还共享三个核心功能:研究、标准和合作。这些功能不仅是AISIs在安全评估方面的关键工作,也支持其他活动,如科学共识构建和基础AI安全研究。尽管AISI模式正日益流行,但该模式也并非没有挑战和局限性。一些分析人士批评第一波AISIs在专业化程度方面过度,以及可能与现有机构(例如)冗余。未来的发展可能会迅速改变这一格局,个别AISIs的特殊性可能无法被本粗略描述所捕捉。本政策简报旨在概述第一波AISIs的核心要素,以促进和改进有关该新型机构模型的讨论,承认这仅是一个简化的快照,而非永恒的指南。

关键词

引用

@article{arxiv.2410.09219,
  title  = {Understanding the First Wave of AI Safety Institutes: Characteristics, Functions, and Challenges},
  author = {Renan Araujo and Kristina Fort and Oliver Guest},
  journal= {arXiv preprint arXiv:2410.09219},
  year   = {2024}
}