基于深度神经网络的旋律乐句分割
机器学习
2018-11-15 v1 声音
机器学习
摘要
自动旋律乐句检测与分割是基于内容的音乐信息检索中的经典任务,也是实现自动音乐结构分析的关键。然而,传统方法仍不能满足实际需求。本文中,我们探索并调整多种神经网络架构,以考察它们能否推广到音乐的符号化表示并产出令人满意的旋律乐句分割。将深度学习方法应用于乐句检测的主要问题是训练集的稀疏标注问题。我们针对不同的神经网络提出了两种定制的标注工程及相应的训练技术,以便在序列层级上做出决策。实验结果表明,CNN-CRF 架构表现最佳,能够提供更精细的分割且训练更快,而 CNN、Bi-LSTM-CNN 和 Bi-LSTM-CRF 是可接受的替代方案。
引用
@article{arxiv.1811.05688,
title = {Melodic Phrase Segmentation By Deep Neural Networks},
author = {Yixing Guan and Jinyu Zhao and Yiqin Qiu and Zheng Zhang and Gus Xia},
journal= {arXiv preprint arXiv:1811.05688},
year = {2018}
}