中文

语音深度伪造检测竞赛场:Speech DF Arena

声音 2025-09-04 v1 计算与语言 音频与语音处理

摘要

与先进深度伪造音频生成技术的发展并行,音频深度伪造检测也取得了显著进展。然而,仍缺乏标准化和全面的基准。为此,我们介绍Speech深度伪造(DeepFake, DF)Arena,首个为音频深度伪造检测提供全面基准测试。Speech DF Arena提供工具箱,以统一评估检测系统,目前覆盖14个多样化数据集和攻击场景,标准化评估指标和协议,以确保可重复性和透明度。它还包括一个排行榜,用于比较和排名系统,以帮助研究人员和开发人员提高其可靠性和鲁棒性。我们包括14个评估数据集,12个最先进的开源检测系统和3个专有检测系统。我们的研究表明,许多系统在跨域场景中表现出高误检率(EER),凸显了需要广泛跨域评估的必要性。该排行榜托管在Huggingface上,GitHub上提供可跨所列数据集复现结果的工具箱。

关键词

引用

@article{arxiv.2509.02859,
  title  = {Speech DF Arena: A Leaderboard for Speech DeepFake Detection Models},
  author = {Sandipana Dowerah and Atharva Kulkarni and Ajinkya Kulkarni and Hoan My Tran and Joonas Kalda and Artem Fedorchenko and Benoit Fauve and Damien Lolive and Tanel Alumäe and Matthew Magimai Doss},
  journal= {arXiv preprint arXiv:2509.02859},
  year   = {2025}
}