中文

MUSAN:一个音乐、语音与噪声语料库

声音 2015-10-30 v1

摘要

本报告介绍了一个由音乐、语音和噪声组成的新语料库。该数据集适用于训练语音活动检测(VAD)以及音乐/语音判别的模型。我们的语料库在灵活的 Creative Commons 许可下发布。该数据集包含来自多种流派的音乐、来自十二种语言的语音,以及广泛的技术和非技术噪声。我们展示了该语料库在广播新闻上的音乐/语音判别以及用于说话人识别的 VAD 中的应用。

关键词

引用

@article{arxiv.1510.08484,
  title  = {MUSAN: A Music, Speech, and Noise Corpus},
  author = {David Snyder and Guoguo Chen and Daniel Povey},
  journal= {arXiv preprint arXiv:1510.08484},
  year   = {2015}
}