基于离散小波变换在调制域中抑制语音谱图细节成分的语音增强方法
音频与语音处理
2018-11-09 v1 声音
摘要
本文提出一种利用离散小波变换(DWT)的新型语音增强(SE)方法。该方法通过减少语音信号谱图中快速时变部分(即 DWT 意义上的细节分量)的量,以突出语音主导成分并获得更好的语音质量。该方法的一个特点是完全无监督,且无需关于所处理语音中干净语音与噪声的先验信息。我们使用 Aurora-2 数据库的一个子集对所提出的基于 DWT 的 SE 方法(对细节部分采用不同缩放因子)进行评估,并以 PESQ 指标指示处理后语音信号的质量。初步结果表明,与原始信号相比,处理后的语音信号呈现出更高的 PESQ 分数。此外,我们表明该方法仍可通过完全丢弃细节部分(将相应缩放因子设为零)来增强信号,这说明谱图可被下采样并由此压缩而不以质量下降为代价。另外,我们将该新方法与传统语音增强算法(包括谱减法、维纳滤波与谱 MMSE 估计)相结合,并表明所得组合优于各自的组成方法。因此,该新方法在提升语音质量方面相当有效,且能良好地补充其他 SE 方法。
引用
@article{arxiv.1811.03486,
title = {Speech Enhancement Based on Reducing the Detail Portion of Speech Spectrograms in Modulation Domain via Discrete Wavelet Transform},
author = {Shih-kuang Lee and Syu-Siang Wang and Yu Tsao and Jeih-weih Hung},
journal= {arXiv preprint arXiv:1811.03486},
year = {2018}
}
备注
4 pages, 4 figures, to appear in ISCSLP 2018