超越基准:AI 监管的虚假承诺
机器学习
2025-12-16 v2 人工智能
计算与语言
摘要
AI 模型在安全基准上的表现并不代表其部署后实际的性能。这种 AI 模型的不透明性使现有的基于基准性能的监管框架无法缓解持续的实际伤害。问题源于 AI 可解释性中的根本性挑战,而这一挑战似乎被监管者和决策者所忽视。我们提出一种简单、现实且可立即使用的监管框架,该框架不依赖基准测试,呼吁跨学科合作寻找新的方式来解决这一关键问题。
引用
@article{arxiv.2501.15693,
title = {Beyond Benchmarks: On The False Promise of AI Regulation},
author = {Gabriel Stanovsky and Renana Keydar and Gadi Perl and Eliya Habba},
journal= {arXiv preprint arXiv:2501.15693},
year = {2025}
}