中文

SpeechVerifier:基于水印的鲁棒声学指纹抗篡改攻击

密码学与安全 2025-06-03 v2 声音 音频与语音处理

摘要

随着社交媒体的激增,恶意篡改的公开演讲,尤其是来自有影响力人物的演讲,严重影响了社会稳定和公众信任。现有的语音篡改检测方法仍然不足:它们要么依赖外部参考数据,要么无法同时具备对攻击的敏感性和对压缩、重采样等良性操作的鲁棒性。为了应对这些挑战,我们引入了 SpeechVerifier,仅使用已发布的语音本身来主动验证语音完整性,即不需要任何外部参考。受音频指纹和水印的启发,SpeechVerifier 能够 (i) 有效地检测篡改攻击,(ii) 对良性操作具有鲁棒性,以及 (iii) 仅基于已发布的语音验证完整性。简而言之,SpeechVerifier 利用多尺度特征提取来捕获不同时间分辨率下的语音特征。然后,它采用对比学习来生成能够检测不同粒度修改的指纹。这些指纹被设计为对良性操作具有鲁棒性,但在发生恶意篡改时表现出显著变化。为了以自包含的方式实现语音验证,生成的指纹随后通过分段水印嵌入到语音信号中。在没有外部参考的情况下,SpeechVerifier 可以从已发布的音频中检索指纹,并与嵌入的水印进行核对以验证语音的完整性。广泛的实验结果表明,所提出的 SpeechVerifier 在检测篡改攻击方面是有效的,并且对良性操作具有鲁棒性。

关键词

引用

@article{arxiv.2505.23821,
  title  = {SpeechVerifier: Robust Acoustic Fingerprint against Tampering Attacks via Watermarking},
  author = {Lingfeng Yao and Chenpei Huang and Shengyao Wang and Junpei Xue and Hanqing Guo and Jiang Liu and Xun Chen and Miao Pan},
  journal= {arXiv preprint arXiv:2505.23821},
  year   = {2025}
}