中文

深度假语音能否被可靠检测?

声音 2024-10-10 v1 密码学与安全 机器学习

摘要

近期文本转语音 (TTS) 系统的进展,特别是具备语音克隆能力的系统,使得语音伪造变得易于获取,引发了由于潜在用于误information 活动和欺诈等恶意用途而引发的伦理和法律顾虑。尽管存在合成语音检测器 (SSD) 来对抗此类问题,但它们对“测试域迁移”脆弱,即在音频经历转码、播放或背景噪声后表现下降。这种脆弱性因针对合成语音的刻意操控而进一步恶化,旨在欺骗检测器。本工作提出了对最新开源 SSD 的此类主动恶意攻击的首个系统性研究。研究从攻击效果和隐蔽性两个方面,考察了白盒攻击、黑盒攻击及其可迁移性,使用硬编码指标和人类评估进行评估。结果凸显了面对不断演变的对抗威胁,更健壮检测方法的紧迫性。

关键词

引用

@article{arxiv.2410.06572,
  title  = {Can DeepFake Speech be Reliably Detected?},
  author = {Hongbin Liu and Youzheng Chen and Arun Narayanan and Athula Balachandran and Pedro J. Moreno and Lun Wang},
  journal= {arXiv preprint arXiv:2410.06572},
  year   = {2024}
}