中文

LibriTTS:一个源自 LibriSpeech 的语音合成语料库

声音 2019-04-08 v1 音频与语音处理

摘要

本文介绍了一个名为“LibriTTS”的、为语音合成设计的新语音语料库。它源自 LibriSpeech 语料库的原始音频与文本材料,而 LibriSpeech 已被用于训练和评估自动语音识别系统。新语料库继承了 LibriSpeech 语料库的理想特性,同时解决了若干使 LibriSpeech 不太适合语音合成工作的问题。发布的语料库包含来自 2,456 位说话人的 585 小时、24kHz 采样率的语音数据及相应文本。实验结果表明,基于 LibriTTS 语料库训练的端到端神经 TTS 模型在六个评估说话人中有五个的自然度平均意见得分超过 4.0。该语料库可从 http://www.openslr.org/60/ 免费下载。

关键词

引用

@article{arxiv.1904.02882,
  title  = {LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech},
  author = {Heiga Zen and Viet Dang and Rob Clark and Yu Zhang and Ron J. Weiss and Ye Jia and Zhifeng Chen and Yonghui Wu},
  journal= {arXiv preprint arXiv:1904.02882},
  year   = {2019}
}

备注

Submitted for Interspeech 2019, 7 pages