音频 DeepFake 检测模型是否为多语言通用解剖?
声音
2025-08-07 v2 音频与语音处理
摘要
由于大多数音频 DeepFake(DF)检测方法是在以英语为中心的数据集上训练的,因此其针对非英语语言的适用性尚未得到充分探讨。本文通过评估各种适应策略,构建针对多语言音频 DF 检测挑战的基准。我们的实验聚焦于分析在英语基准数据集上训练的模型,以及同语言(intra-linguistic)和跨语言(cross-linguistic)适应方法。我们的结果表明,检测效果在多语言情境下存在显著差异,凸显了多语言设置的难度。我们展示,仅限英语数据集会负面影响检测效果,强调目标语言数据集的重要性。
关键词
引用
@article{arxiv.2412.17924,
title = {Are audio DeepFake detection models polyglots?},
author = {Bartłomiej Marek and Piotr Kawa and Piotr Syga},
journal= {arXiv preprint arXiv:2412.17924},
year = {2025}
}
备注
Keywords: Audio DeepFakes, DeepFake detection, multilingual audio DeepFakes