基于多通道 NMF 与声学跟踪的运动声源分离
声音
2017-10-30 v1 音频与语音处理
摘要
本文提出一种运动声源分离方法。该方法首先跟踪声源,随后利用多通道非负矩阵分解(NMF)估计源谱图,并通过单通道维纳滤波从混合信号中提取声源。我们提出了一种具有时变混合(由空间协方差矩阵(SCM)表示)的新型多通道 NMF 模型,并给出最小化平方 Frobenius 范数的模型参数更新方程。模型的 SCM 基于每帧跟踪声源的估计到达方向获得。评估基于既定的客观分离准则,并使用两个与三个同时运动声源的真实录音。对比方法包括常规波束成形与理想比率掩码分离。所提方法在所有测量指标上均显示出优于其他被评估盲分离方法的分离质量。此外,我们通过比较使用标注真值源轨迹所获得的分离质量,评估了该方法对跟踪误差的敏感性。
引用
@article{arxiv.1710.10005,
title = {Separation of Moving Sound Sources Using Multichannel NMF and Acoustic Tracking},
author = {Joonas Nikunen and Aleksandr Diment and Tuomas Virtanen},
journal= {arXiv preprint arXiv:1710.10005},
year = {2017}
}
备注
Preprint of manuscript submitted to IEEE/ACM Transactions on Audio Speech and Language processing (R1)