基于自定义中侧信号与单声道处理的立体声语音增强
音频与语音处理
2022-11-29 v1 声音
信号处理
摘要
语音增强(SE)系统通常处理单声道输入,并用于语音通信和用户生成内容的采集清理等应用。这些应用所用设备的近期进展与变化可能导致相同应用中双通道内容数量的增加。然而,SE系统通常针对单声道输入设计;使用通道独立或中侧处理等简单方法产生的立体声结果可能不尽如人意,包括显著的语音失真。为此,我们提出一种创建称为自定义中侧信号(CMSS)的立体声信号新表示的系统。CMSS将中侧信号对中央声像语音的优势扩展至更广泛的一类输入信号。这进而允许任何现有单声道SE系统通过处理自定义中信号作为高效立体声系统运行。我们描述了CMSS所需参数如何由空间级滤波源分离系统的组件高效估计。在使用最先进的基于深度学习的SE系统对各种语音混合风格的立体声内容进行主观试听表明,CMSS处理以约通道独立处理一半的代价提升了语音质量。
引用
@article{arxiv.2211.14378,
title = {Stereo Speech Enhancement Using Custom Mid-Side Signals and Monaural Processing},
author = {Aaron Master and Lie Lu and Nathan Swedlow},
journal= {arXiv preprint arXiv:2211.14378},
year = {2022}
}
备注
12 pages, 5 figures. Submitted to the Journal of the Audio Engineering Society