中文

一种用于语音增强的循环变分自编码器

机器学习 2020-02-11 v2 人工智能 神经与进化计算 声音 音频与语音处理

摘要

本文提出一种基于循环变分自编码器(RVAE)的语音增强生成方法。该深度生成语音模型仅使用干净语音信号进行训练,并与非负矩阵分解噪声模型结合用于语音增强。我们提出一种变分期望最大化算法,其中 RVAE 的编码器在测试时被微调,以近似给定含噪语音观测下潜变量的分布。与先前基于前馈全连接架构的方法相比,所提出的循环深度生成语音模型在潜变量上引入了后验时间动态,这被证明可改善语音增强结果。

关键词

引用

@article{arxiv.1910.10942,
  title  = {A Recurrent Variational Autoencoder for Speech Enhancement},
  author = {Simon Leglaive and Xavier Alameda-Pineda and Laurent Girin and Radu Horaud},
  journal= {arXiv preprint arXiv:1910.10942},
  year   = {2020}
}