中文

语音信号单通道盲去回声技术

音频与语音处理 2025-12-30 v1

摘要

语音信号的去回声是语音处理中最相关的问题之一。本文旨在理解和实现旨在增强语音信号幅声谱图以去除引入回声效应的去回声技术。提出一种从回声语音幅声谱图估计干净语音幅声谱图的方法。通过非负矩阵分解(NMFD)实现。进一步采用 NMF 表示扩展用于语音幅声谱图。为利用时序依赖性,引入卷积 NMF 基于表示和帧堆叠模型到 NMFD 框架中用于语音。还提出一种通过对回声幅声谱图的激活矩阵应用 NMFD 实现去回声的新方法。最后,基于两个关键客观指标——PESQ 和 Cepstral Distortion——呈现所列技术的性能比较分析,使用 TIMIT 数据库中的句子录音和来自 Reverb 2014 挑战赛的录制房间脉冲响应。虽然我们能够在定性上验证文献中关于这些技术的主张,但无法匹配确切结果。该新方法,正如其所述,在定量指标上提供改进,但不一致。

关键词

引用

@article{arxiv.2512.23322,
  title  = {Single Channel Blind Dereverberation of Speech Signals},
  author = {Dhruv Nigam},
  journal= {arXiv preprint arXiv:2512.23322},
  year   = {2025}
}