中文

调制域中基于模型的语音增强

声音 2018-02-01 v3

摘要

本文提出一种利用卡尔曼滤波器的调制域语音增强算法。所提出的估计器在语音与噪声在复数域可加的假设下,联合建模语音与噪声谱幅度的估计动态,以获得语音幅度谱的 MMSE 估计。为了将噪声幅度动态与语音幅度动态结合,我们提出一种统计“Gaussring”模型,该模型由混合高斯组成,其均值中心位于复平面上的一个圆上。所提算法的性能使用语音质量感知评价测度、分段 SNR 测度和短时客观可懂度测度进行评估。对于语音质量测度,与竞争算法相比,所提算法在宽 SNR 范围内表现出一致的改进。语音识别实验也表明,基于 Gaussring 模型的算法对两类噪声表现良好。

关键词

引用

@article{arxiv.1707.02651,
  title  = {Model-Based Speech Enhancement in the Modulation Domain},
  author = {Yu Wang and Mike Brookes},
  journal= {arXiv preprint arXiv:1707.02651},
  year   = {2018}
}

备注

15 pages, 18 figures; IEEE/ACM Transactions on Audio, Speech and Language Processing, Vol. 26, No. 3, Mar. 2018