中文

用于歌声分离的信息化组稀疏表示

音频与语音处理 2018-01-12 v1 信息检索 声音 信号处理 机器学习

摘要

歌声分离旨在将音乐录音中的人声与伴奏部分分离,是音乐信息检索中的基础问题。近期关于歌声分离的研究表明,低秩表示与信息化分离方法均能提升分离质量。然而,由于使用了奇异值分解,低秩优化在计算上效率低下。因此,本文提出一种称为信息化组稀疏表示的线性时间新算法,并利用音高标注作为侧信息将人声从音乐中分离。在iKala数据集上的实验结果证实了该方法的有效性,表明在给定预训练伴奏字典时,音乐伴奏遵循组稀疏结构。我们还展示了如何通过DSD100数据集轻松扩展本工作以适配多字典。

关键词

引用

@article{arxiv.1801.03815,
  title  = {Informed Group-Sparse Representation for Singing Voice Separation},
  author = {Tak-Shing T. Chan and Yi-Hsuan Yang},
  journal= {arXiv preprint arXiv:1801.03815},
  year   = {2018}
}

备注

5 pages, 1 figure