JVS 语料库:免费日语多说话人语音语料库
声音
2019-08-20 v1 音频与语音处理
摘要
得益于包括深度学习在内的机器学习技术的进步,语音合成正成为一项机器学习任务。为加速语音合成研究,我们正在开发不仅学术机构而且商业公司都能合理获取的日语语音语料库。2017 年,我们发布了 JSUT 语料库,包含由单一说话人朗读的 10 小时语音,用于端到端文本到语音合成。为在语音合成研究中更通用的用途(例如语音转换和多说话人建模),本文构建了 JVS 语料库,包含 100 位说话人以三种风格(正常、耳语和假声)录制的语音数据。该语料库包含 30 小时语音数据,其中包括 22 小时平行正常语音。本文描述了我们如何设计该语料库并总结其规格。该语料库可在我们的项目页面获取。
引用
@article{arxiv.1908.06248,
title = {JVS corpus: free Japanese multi-speaker voice corpus},
author = {Shinnosuke Takamichi and Kentaro Mitsui and Yuki Saito and Tomoki Koriyama and Naoko Tanji and Hiroshi Saruwatari},
journal= {arXiv preprint arXiv:1908.06248},
year = {2019}
}