NNSVS:一个基于神经网络的歌声合成工具包
音频与语音处理
2023-03-02 v2 机器学习
声音
信号处理
摘要
本文描述了NNSVS的设计,这是一个用于基于神经网络的歌声合成研究的开源软件。NNSVS受歌声合成研究开源先驱Sinsy的启发,并提供了许多附加特性,如多流模型、自回归基频模型和神经声码器。此外,NNSVS提供了详尽的文档和大量脚本以构建完整的歌声合成系统。实验结果表明,我们的最佳系统显著优于我们对Sinsy的复现及其他基线系统。该工具包可在 https://github.com/nnsvs/nnsvs 获取。
引用
@article{arxiv.2210.15987,
title = {NNSVS: A Neural Network-Based Singing Voice Synthesis Toolkit},
author = {Ryuichi Yamamoto and Reo Yoneyama and Tomoki Toda},
journal= {arXiv preprint arXiv:2210.15987},
year = {2023}
}
备注
Accepted to ICASSP 2023