中文

NNSVS:一个基于神经网络的歌声合成工具包

音频与语音处理 2023-03-02 v2 机器学习 声音 信号处理

摘要

本文描述了NNSVS的设计,这是一个用于基于神经网络的歌声合成研究的开源软件。NNSVS受歌声合成研究开源先驱Sinsy的启发,并提供了许多附加特性,如多流模型、自回归基频模型和神经声码器。此外,NNSVS提供了详尽的文档和大量脚本以构建完整的歌声合成系统。实验结果表明,我们的最佳系统显著优于我们对Sinsy的复现及其他基线系统。该工具包可在 https://github.com/nnsvs/nnsvs 获取。

关键词

引用

@article{arxiv.2210.15987,
  title  = {NNSVS: A Neural Network-Based Singing Voice Synthesis Toolkit},
  author = {Ryuichi Yamamoto and Reo Yoneyama and Tomoki Toda},
  journal= {arXiv preprint arXiv:2210.15987},
  year   = {2023}
}

备注

Accepted to ICASSP 2023