基于谐波与非谐波的时域含噪混响语音增强
音频与语音处理
2021-12-10 v1 声音
摘要
本文介绍一种名为 HnH-NRSE 的单步时域方法,旨在含噪混响条件下同时改善语音可懂度与质量。该方案中,通过应用过零与能量准则分离语音的谐波与非谐波成分。进一步对其非平稳度进行客观评估,并用于自适应增益以处理掩蔽成分。该技术无需语音统计或房间信息的先验知识。此外,提出两种组合方案 IRMO 与 IRMN 作为改善含噪混响语音信号的复合方法。所提方法与基线方法考虑两项可懂度与三项质量度量进行评估,用于客观预测。结果表明,在大多数场景下,所提方案相较竞争方法带来更高的可懂度与质量改善。此外,进行了感知可懂度听测,与这些结果相符。进而,所提 HnH-NRSE 方案在 SRMR 质量度量上取得与复合 IRMO 和 IRMN 技术相近的结果。
引用
@article{arxiv.2112.04949,
title = {Harmonic and non-Harmonic Based Noisy Reverberant Speech Enhancement in Time Domain},
author = {G. Zucatelli and R. Coelho},
journal= {arXiv preprint arXiv:2112.04949},
year = {2021}
}
备注
9 pages