中文

深度伪造语音的被动与主动检测比较研究

声音 2025-06-18 v1

摘要

针对深度伪造语音的防御方案可分为两类:主动水印模型和被动常规深度伪造探测器。尽管两者都针对常见威胁,但它们在训练、优化和评估方面的差异,导致无法采用统一的协议进行联合评估和为不同情形选择最佳方案。本文提出了一个评估这两种模型类型的框架,用于深度伪造语音检测。为确保公平比较并最小化差异,所有模型均在共同数据集上进行训练和测试,并使用共享指标进行性能评估。我们还分析了它们对各种对抗攻击的鲁棒性,显示不同模型对不同的语音属性扭曲具有不同脆弱性。我们的训练和评估代码已在 Github 上提供。

关键词

引用

@article{arxiv.2506.14398,
  title  = {A Comparative Study on Proactive and Passive Detection of Deepfake Speech},
  author = {Chia-Hua Wu and Wanying Ge and Xin Wang and Junichi Yamagishi and Yu Tsao and Hsin-Min Wang},
  journal= {arXiv preprint arXiv:2506.14398},
  year   = {2025}
}