中文

双阶段低复杂度可重构语音增强

音频与语音处理 2021-05-18 v1 声音 信号处理

摘要

本文提出一种双阶段、低复杂度且可重构的技术,用于增强被各类噪声源污染的语音。在输入数据与音频内容的驱动下,所提出的双阶段语音增强方法分别在第一阶段和第二阶段执行粗处理与细处理。本文证明,该语音增强方案显著提升了远程通信语音质量三重评估(3QUEST,含近场与远场应用的语音平均意见得分(SMOS)与噪声平均意见得分(NMOS))的指标。此外,该语音增强方法大幅改善了信噪比(SNR)与主观听感。作为对比,传统语音增强方法虽提升了NMOS与SNR,却降低了SMOS。另外,该语音增强方案可便捷地部署于语音通信与会议系统以及语音触发应用的采集路径与语音渲染路径中。

关键词

引用

@article{arxiv.2105.07632,
  title  = {Dual-Stage Low-Complexity Reconfigurable Speech Enhancement},
  author = {Jun Yang and Nico Brailovsky},
  journal= {arXiv preprint arXiv:2105.07632},
  year   = {2021}
}

备注

5 pages