语音不可区分性:在隐私保护语音数据发布中保护声纹
密码学与安全
2020-04-17 v1 声音
音频与语音处理
摘要
随着智能设备(如Amazon Echo和Apple的HomePod)的发展,语音数据已成为大数据的新维度。然而,隐私和安全问题可能阻碍包含说话人可识别信息(即声纹,被视为一种生物识别标识符)的真实世界语音数据的收集和共享。当前关于声纹隐私保护的研究既未提供有意义的隐私-效用权衡,也未给出形式化且严格的隐私定义。在本研究中,我们通过扩展差分隐私,设计了一种新颖且严格的声纹隐私度量,称为语音不可区分性(voice-indistinguishability)。我们还提出了满足语音不可区分性的隐私保护语音数据发布的机制与框架。在公开数据集上的实验验证了所提方法的有效性和高效性。
引用
@article{arxiv.2004.07442,
title = {Voice-Indistinguishability: Protecting Voiceprint in Privacy-Preserving Speech Data Release},
author = {Yaowei Han and Sheng Li and Yang Cao and Qiang Ma and Masatoshi Yoshikawa},
journal= {arXiv preprint arXiv:2004.07442},
year = {2020}
}
备注
The paper has been accepted by the IEEE International Conference on Multimedia & Expo 2020(ICME 2020)