利用多歌手歌唱合成系统解耦音色与演唱风格
声音
2019-10-30 v1 音频与语音处理
摘要
在本研究中,我们将歌手的身份定义为两个独立的概念——音色与演唱风格,并提出一种能够分别建模二者的多歌手歌唱合成系统。为此,我们通过以下方式将单歌手模型扩展为多歌手模型:首先,我们设计了一个能够充分反映歌手身份的身份编码器。其次,我们使用编码后的歌手身份来条件化两个分别建模音色与演唱风格的独立解码器。通过带有听感测试的用户研究,我们从实验上验证了所提出的框架能够在独立控制音色与演唱风格的同时,生成高质量的自然歌唱声音。此外,通过固定音色而改变演唱风格的方法,我们表明所提出的网络能够产生更具表现力的歌唱声音。
引用
@article{arxiv.1910.13069,
title = {Disentangling Timbre and Singing Style with Multi-singer Singing Synthesis System},
author = {Juheon Lee and Hyeong-Seok Choi and Junghyun Koo and Kyogu Lee},
journal= {arXiv preprint arXiv:1910.13069},
year = {2019}
}
备注
4 pages, Submitted to ICASSP2020