中文

GPAI 评估标准工作组:致于有效的人工智能治理

计算机与社会 2024-11-22 v1

摘要

通用人工智能评估已被提出作为识别和缓解人工智能发展与部署所潜在系统性风险的有前景的方式。尽管 GPAI 评估在制度决策和政策制定中发挥着日益重要的作用——包括欧盟人工智能法案要求对 presenting 系统性风险的 GPAI 模型进行评估——但迄今尚无任何标准以促进其质量或合法性。为强化欧盟的 GPAI 评估(目前唯一一个要求 GPAI 评估的司法管辖区),我们概述了四项 GPAI 评估的必要条件:内部有效性、外部有效性、可重复性和可移植性。为在风险不断演变的动态环境中维持这些必要条件,我们提出设立一个专门的欧盟 GPAI 评估标准工作组,该工作组将置于欧盟人工智能法案所建立的机构内部。我们概述了工作组成员的职责,指定 GPAI 提供方承诺以促进工作组成员成功,讨论该工作组成员对全球人工智能治理潜在影响,以及应注意的潜在失败来源。

关键词

引用

@article{arxiv.2411.13808,
  title  = {GPAI Evaluations Standards Taskforce: Towards Effective AI Governance},
  author = {Patricia Paskov and Lukas Berglund and Everett Smith and Lisa Soder},
  journal= {arXiv preprint arXiv:2411.13808},
  year   = {2024}
}