中文

通过多判别器 CycleGAN 语音增强改善噪声语音上的语音识别

计算与语言 2021-12-14 v1 声音 音频与语音处理

摘要

本文介绍了我们近期关于通过语音增强改善噪声语音自动语音识别的研究。我们提出一种名为多判别器 CycleGAN 的新方法,以降低输入语音的噪声,从而改善自动语音识别性能。我们所提方法利用 CycleGAN 框架进行无并行数据的语音增强,并通过引入检查不同频率区域的多个判别器加以改进。此外,我们表明在训练数据的同质子集上训练多个生成器优于在所有训练数据上训练一个生成器。我们在 CHiME-3 数据集上评估了我们的方法,观察到开发集上相对 WER 最高改善 10.03%,评估集上最高改善 14.09%。

关键词

引用

@article{arxiv.2112.06309,
  title  = {Improving Speech Recognition on Noisy Speech via Speech Enhancement with Multi-Discriminators CycleGAN},
  author = {Chia-Yu Li and Ngoc Thang Vu},
  journal= {arXiv preprint arXiv:2112.06309},
  year   = {2021}
}

备注

6 pages, 9 figures, ASRU 2021