中文

基于深度学习的齐唱分析与合成框架

音频与语音处理 2020-09-22 v1 机器学习

摘要

齐唱是指一组歌手同时演唱相同旋律和歌词的称谓。尽管齐唱中每位歌手演唱相同的主旋律,但歌手之间存在轻微的时机和音高偏差,这些偏差连同音色的集合给听者一种感知上的“齐唱”感。在本文中,我们在合唱背景下对齐唱进行研究;利用一些最近提出的基于深度学习的方法,我们分析齐唱混合录音中个别歌手的基频(F0)分布。基于该分析,我们提出一种从清唱输入和代表齐唱混合的单声音原型合成齐唱信号的系统。我们使用主观听音测试来评估我们所提合成系统在感知因素上的表现,包括质量、对旋律的遵循程度以及感知齐唱的程度。

关键词

引用

@article{arxiv.2009.09875,
  title  = {A Deep Learning Based Analysis-Synthesis Framework For Unison Singing},
  author = {Pritish Chandna and Helena Cuesta and Emilia Gómez},
  journal= {arXiv preprint arXiv:2009.09875},
  year   = {2020}
}