JSUT 语料库:用于端到端语音合成的免费大规模日语语音语料库
计算与语言
2017-11-02 v1
摘要
得益于包括深度学习在内的机器学习技术的进步,可在学术机构和商业公司之间共享的免费大规模语音语料库发挥着重要作用。然而,用于日语语音合成的此类语料库尚不存在。在本文中,我们设计了一个名为“JSUT 语料库”的新型日语语音语料库,旨在实现端到端语音合成。该语料库包含 10 小时的朗读式语音数据及其转写文本,并涵盖日常使用日语字符的所有主要发音。在本文中,我们描述了如何设计和分析该语料库。该语料库可免费在线获取。
引用
@article{arxiv.1711.00354,
title = {JSUT corpus: free large-scale Japanese speech corpus for end-to-end speech synthesis},
author = {Ryosuke Sonobe and Shinnosuke Takamichi and Hiroshi Saruwatari},
journal= {arXiv preprint arXiv:1711.00354},
year = {2017}
}
备注
Submitted to ICASSP2018