大数据时代的说话人隐私与安全:对抗深度伪造的保护与防御
音频与语音处理
2025-09-10 v2
摘要
在大数据时代,个人化语音生成技术取得了显著进展,这些技术利用说话人的属性(包括声音和说话风格)来生成深度伪造语音。这也放大了来自深度伪造语音滥用的全球安全风险,造成巨大的社会成本。为应对深度伪造语音所构成的安全威胁,已developed出针对声音属性的保护技术以及针对深度伪造语音的防御技术。其中,声音匿名化技术用于保护声音属性免受提取以用于深度伪造生成,而深度伪造检测和水印技术则用于防御深度伪造语音的滥用。本文提供了这三种技术的简短概述,描述了方法、进展和挑战。更为详尽的版本将在近期出版。
引用
@article{arxiv.2509.06361,
title = {Speaker Privacy and Security in the Big Data Era: Protection and Defense against Deepfake},
author = {Liping Chen and Kong Aik Lee and Zhen-Hua Ling and Xin Wang and Rohan Kumar Das and Tomoki Toda and Haizhou Li},
journal= {arXiv preprint arXiv:2509.06361},
year = {2025}
}