基于混合去噪网络的多域处理语音增强方法
音频与语音处理
2018-12-24 v1 声音
摘要
我们提出了一种混合框架,利用音频表示中时间精度与频率精度之间的权衡来提升语音增强任务的性能。我们首先表明,使用特定表示(如原始音频和频谱图)的传统方法在针对不同类型噪声时各自有效。通过整合两种方法,我们的模型能够学习多尺度与多域特征,以互补的方式有效去除时频空间中不同区域存在的噪声。实验结果表明,所提出的混合模型比单独使用每种模型具有更好的性能与鲁棒性。
引用
@article{arxiv.1812.08914,
title = {Multi-Domain Processing via Hybrid Denoising Networks for Speech Enhancement},
author = {Jang-Hyun Kim and Jaejun Yoo and Sanghyuk Chun and Adrian Kim and Jung-Woo Ha},
journal= {arXiv preprint arXiv:1812.08914},
year = {2018}
}
备注
7pages, 6 figures, 2 tables