中文

MLS:用于语音研究的大规模多语言数据集

音频与语音处理 2020-12-22 v2 计算与语言 声音

摘要

本文介绍多语言 LibriSpeech(MLS)数据集,一个适用于语音研究的大型多语言语料库。该数据集源自 LibriVox 的有声读物朗读录音,包含 8 种语言,其中英语约 44.5K 小时,其他语言总计约 6K 小时。此外,我们为数据集中所有语言提供了语言模型(LM)和基线自动语音识别(ASR)模型。我们相信如此大规模的转写数据集将为 ASR 和文本到语音(TTS)研究开辟新途径。该数据集将在 http://www.openslr.org 免费提供给任何人。

关键词

引用

@article{arxiv.2012.03411,
  title  = {MLS: A Large-Scale Multilingual Dataset for Speech Research},
  author = {Vineel Pratap and Qiantong Xu and Anuroop Sriram and Gabriel Synnaeve and Ronan Collobert},
  journal= {arXiv preprint arXiv:2012.03411},
  year   = {2020}
}