中文

JVS-MuSiC:日语多说话人歌唱语音语料库

声音 2020-01-22 v1 音频与语音处理

摘要

得益于机器学习技术的发展,合成单一歌手的高质量歌唱语音已成为可能。一个开放的多说话人歌唱语音语料库将进一步加速歌唱语音合成的研究。然而,传统的歌唱语音语料库仅由单一歌手的歌唱语音组成。我们设计了一个名为“JVS-MuSiC”的日语多说话人歌唱语音语料库,旨在分析和合成多样化的声音。该语料库包含100位歌手对同一首日本儿歌《Katatsumuri》的录音,还包含每位歌手不同的另一首歌曲。本文中,我们描述了该语料库的设计以及使用JVS-MuSiC的实验分析。我们研究了1)歌唱语音相似度与齐唱语音感知统一性之间的关系,以及2)歌唱语音相似度与语音相似度之间的关系。结果表明:1)歌唱语音相似度与齐唱统一性之间存在中等程度的正相关;2)歌唱语音相似度与语音相似度之间的相关性较弱。该语料库可在线免费获取。

关键词

引用

@article{arxiv.2001.07044,
  title  = {JVS-MuSiC: Japanese multispeaker singing-voice corpus},
  author = {Hiroki Tamaru and Shinnosuke Takamichi and Naoko Tanji and Hiroshi Saruwatari},
  journal= {arXiv preprint arXiv:2001.07044},
  year   = {2020}
}