用于歌声分离的混合Y-Net架构
声音
2023-03-07 v1 机器学习
音频与语音处理
摘要
本研究论文提出一种名为 Y-Net 的基于深度学习的神经网络新架构,用于实现音乐源分离。所提架构通过从谱图与波形域提取特征来进行端到端混合源分离。受 U-Net 架构启发,Y-Net 预测谱图掩码以从混合信号中分离人声源。我们的结果证明了所提架构以更少参数实现音乐源分离的有效性。总体而言,我们的工作为提升音乐源分离的精度与效率提供了一种有前景的方法。
引用
@article{arxiv.2303.02599,
title = {Hybrid Y-Net Architecture for Singing Voice Separation},
author = {Rashen Fernando and Pamudu Ranasinghe and Udula Ranasinghe and Janaka Wijayakulasooriya and Pantaleon Perera},
journal= {arXiv preprint arXiv:2303.02599},
year = {2023}
}
备注
Submitted for EUSIPCO23: 5 Pages, 7 figures