中文

SynVox2:迈向隐私友好的 VoxCeleb2 数据集

声音 2023-09-13 v1 音频与语音处理

摘要

深度学习在说话人识别上的成功高度依赖于大规模数据集的使用。然而,当使用从真实人类说话人收集的大规模自然语音数据集时,深度学习方法的数据渴求特性已因伦理、隐私和法律担忧而受到质疑。例如,广泛使用的用于说话人识别的 VoxCeleb2 数据集已不再可从官网获取。为缓解这些担忧,本工作提出一项倡议,生成隐私友好的合成 VoxCeleb2 数据集,确保所生成语音在隐私、效用和公平性方面的质量。我们也讨论了将合成数据用于说话人验证下游任务的挑战。

关键词

引用

@article{arxiv.2309.06141,
  title  = {SynVox2: Towards a privacy-friendly VoxCeleb2 dataset},
  author = {Xiaoxiao Miao and Xin Wang and Erica Cooper and Junichi Yamagishi and Nicholas Evans and Massimiliano Todisco and Jean-François Bonastre and Mickael Rouvier},
  journal= {arXiv preprint arXiv:2309.06141},
  year   = {2023}
}

备注

conference