中文

基于块卷积神经网络的歌声旋律提取

声音 2018-04-26 v1 音频与语音处理

摘要

本文提出一种用于复调音乐中歌声旋律提取的基于块(patch-based)的卷积神经网络(CNN)模型,其灵感来自图像处理中的目标检测。该模型的输入是一种新颖的时频表示,可增强音高轮廓并抑制信号的谐波成分。这种简洁的数据表示与基于块的 CNN 模型使得在有限标注数据下即可高效训练。在多个数据集上的实验表明,与其他深度学习方法相比,该方法具有出色的速度和具竞争力的精度。

关键词

引用

@article{arxiv.1804.09202,
  title  = {Vocal melody extraction using patch-based CNN},
  author = {Li Su},
  journal= {arXiv preprint arXiv:1804.09202},
  year   = {2018}
}