用于歌声分离的信息化组稀疏表示
音频与语音处理
2018-01-12 v1 信息检索
声音
信号处理
机器学习
摘要
歌声分离旨在将音乐录音中的人声与伴奏部分分离,是音乐信息检索中的基础问题。近期关于歌声分离的研究表明,低秩表示与信息化分离方法均能提升分离质量。然而,由于使用了奇异值分解,低秩优化在计算上效率低下。因此,本文提出一种称为信息化组稀疏表示的线性时间新算法,并利用音高标注作为侧信息将人声从音乐中分离。在iKala数据集上的实验结果证实了该方法的有效性,表明在给定预训练伴奏字典时,音乐伴奏遵循组稀疏结构。我们还展示了如何通过DSD100数据集轻松扩展本工作以适配多字典。
引用
@article{arxiv.1801.03815,
title = {Informed Group-Sparse Representation for Singing Voice Separation},
author = {Tak-Shing T. Chan and Yi-Hsuan Yang},
journal= {arXiv preprint arXiv:1801.03815},
year = {2018}
}
备注
5 pages, 1 figure