中文

adverse 声学条件下基于单麦克风的两阶段说话人提取算法

声音 2023-03-14 v1 音频与语音处理

摘要

本工作中,我们提出一种在混响与噪声条件下进行说话人提取的两阶段方法。给定目标说话人的参考信号,首先从噪声混合信号中提取出干净但仍带混响的目标说话人信号。在第二阶段,通过联合去混响与残留噪声及干扰抑制对该提取信号作进一步增强。所提架构包含两个子网络,分别用于提取任务与去混响任务。我们给出了该架构的训练策略,并表明在 WHAMR! 数据集上所提方法性能与其他最先进(SOTA)方法相当。此外,我们提出了一个具有更真实 adverse 声学条件的新数据集,并表明该方法应用于该数据集时同样优于对比方法。

关键词

引用

@article{arxiv.2303.07072,
  title  = {A two-stage speaker extraction algorithm under adverse acoustic conditions using a single-microphone},
  author = {Aviad Eisenberg and Sharon Gannot and Shlomo E. Chazan},
  journal= {arXiv preprint arXiv:2303.07072},
  year   = {2023}
}