LiveSecBench:面向中文语言模型应用场景的动态事件驱动安全基准
计算与语言
2025-12-23 v2
摘要
我们介绍 LiveSecBench,这是一个持续更新的、专为中文语言模型应用场景设计的安全基准。LiveSecBench 通过结合自动生成与人工验证的管道构建高质量且独特的数据集。通过定期发布新版本扩充数据集并更新评估指标,LiveSecBench 为 AI 安全提供了稳健且最新的标准。在本报告中,我们介绍我们的第二个版本 v251215,覆盖五个维度(公共安全、公平性与偏见、隐私、真实性及心理健康安全)。我们使用 ELO 评级系统评估 57 个代表性语言模型,提供当前中文语言模型安全状况的排行榜。结果可访问 https://livesecbench.intokentech.cn/。
引用
@article{arxiv.2511.02366,
title = {LiveSecBench: A Dynamic and Event-Driven Safety Benchmark for Chinese Language Model Applications},
author = {Yudong Li and Peiru Yang and Feng Huang and Zhongliang Yang and Kecheng Wang and Haitian Li and Baocheng Chen and Xingyu An and Ziyu Liu and Youdan Yang and Kejiang Chen and Sifang Wan and Xu Wang and Yufei Sun and Liyan Wu and Ruiqi Zhou and Wenya Wen and Xingchi Gu and Tianxin Zhang and Yue Gao and Yongfeng Huang},
journal= {arXiv preprint arXiv:2511.02366},
year = {2025}
}