中文

基于 X-vector 的说话人匿名化的设计选择

音频与语音处理 2020-05-19 v1 计算与语言

摘要

近期提出的基于 x-vector 的匿名化方案将任意输入语音转换为随机伪说话人的语音。在本文中,我们提出一种灵活的伪说话人选择技术,作为首届 VoicePrivacy Challenge 的基线。我们探讨了关于说话人间距离度量、选取伪说话人的 x-vector 空间区域以及性别选择方面的若干设计选择。为评估所实现匿名化的强度,我们考虑使用基于 x-vector 的说话人验证系统的攻击者,其可能根据对匿名化方案的知晓情况使用原始或匿名化语音进行注册。以攻击者达到的等错误率(EER)以及匿名化数据上的解码词错误率(WER)作为隐私与效用的度量。实验使用源自 LibriSpeech 的数据集进行,以寻找在隐私与效用方面最优的设计选择组合。

关键词

引用

@article{arxiv.2005.08601,
  title  = {Design Choices for X-vector Based Speaker Anonymization},
  author = {Brij Mohan Lal Srivastava and Natalia Tomashenko and Xin Wang and Emmanuel Vincent and Junichi Yamagishi and Mohamed Maouche and Aurélien Bellet and Marc Tommasi},
  journal= {arXiv preprint arXiv:2005.08601},
  year   = {2020}
}