中文

探索利用对齐歌词信息的歌声分离

音频与语音处理 2020-08-12 v1 声音

摘要

本文中,我们提出一种利用对齐歌词作为附加信息以提升歌声分离性能的方法。我们将基于 highway network 的歌词编码器整合进 Open-unmix 分离网络,并表明使用对齐歌词训练的模型确实比未提供该信息的模型表现更优。现在的问题在于,性能的提升是否确实源于所给对齐歌词中的语音内容。为此,我们通过观察向模型输入错误歌词时性能的变化,以多方面方式探究了性能提升的来源。实验结果表明,该模型不仅能利用人声活动信息,还能利用来自对齐歌词的语音内容。

关键词

引用

@article{arxiv.2008.04482,
  title  = {Exploring Aligned Lyrics-Informed Singing Voice Separation},
  author = {Chang-Bin Jeon and Hyeong-Seok Choi and Kyogu Lee},
  journal= {arXiv preprint arXiv:2008.04482},
  year   = {2020}
}

备注

8 pages (2 for references), 7 figures, 5 tables, Appearing in the proceedings of the 21st International Society for Music Information Retrieval Conference (ISMIR 2020) (camera-ready version)