基于 x-vectors 主导说话人识别监督的自适应盲音频源提取
音频与语音处理
2019-10-28 v1 声音
信号处理
摘要
我们提出了一种用于自适应盲音频源提取的新算法。所提方法基于独立向量分析,并利用辅助函数优化以实现高收敛速度。该算法由与感兴趣源(SOI)相关的导频信号部分监督,从而确保方法正确提取目标说话人的话语。该导频基于使用 x-vectors 对混合信号中主导说话人的识别。我们实验分析了在串扰存在情况下计算的 x-vectors 的性质。所提方法在一个具有移动 SOI、静态干扰说话人和环境噪声的场景中得到了验证。
引用
@article{arxiv.1910.11824,
title = {Adaptive blind audio source extraction supervised by dominant speaker identification using x-vectors},
author = {Jakub Janský and Jiří Málek and Jaroslav Čmejla and Tomáš Kounovský and Zbyněk Koldovský and Jindřich Žďánský},
journal= {arXiv preprint arXiv:1910.11824},
year = {2019}
}