中文

基于 x-vectors 主导说话人识别监督的自适应盲音频源提取

音频与语音处理 2019-10-28 v1 声音 信号处理

摘要

我们提出了一种用于自适应盲音频源提取的新算法。所提方法基于独立向量分析,并利用辅助函数优化以实现高收敛速度。该算法由与感兴趣源(SOI)相关的导频信号部分监督,从而确保方法正确提取目标说话人的话语。该导频基于使用 x-vectors 对混合信号中主导说话人的识别。我们实验分析了在串扰存在情况下计算的 x-vectors 的性质。所提方法在一个具有移动 SOI、静态干扰说话人和环境噪声的场景中得到了验证。

关键词

引用

@article{arxiv.1910.11824,
  title  = {Adaptive blind audio source extraction supervised by dominant speaker identification using x-vectors},
  author = {Jakub Janský and Jiří Málek and Jaroslav Čmejla and Tomáš Kounovský and Zbyněk Koldovský and Jindřich Žďánský},
  journal= {arXiv preprint arXiv:1910.11824},
  year   = {2019}
}