Gesper:一种通用语音重建的恢复-增强框架
声音
2023-06-16 v1 音频与语音处理
摘要
本文描述了提交至ICASSP 2023语音信号改善(SSI)挑战赛的实时通用语音重建(Gesper)系统。该新提出的系统是一种两阶段架构,先执行语音恢复,再级联语音增强。我们首次提出基于复谱映射的生成对抗网络(CSM-GAN)作为第一阶段的语音恢复模块。对于噪声抑制与去混响,增强模块采用全带-宽带并行处理。在ICASSP 2023 SSI挑战赛的盲测试集上,所提出的满足实时条件的Gesper系统取得了3.27的P.804总体平均意见得分(MOS)与3.35的P.835总体MOS,在赛道1与赛道2均排名第1。
引用
@article{arxiv.2306.08454,
title = {Gesper: A Restoration-Enhancement Framework for General Speech Reconstruction},
author = {Wenzhe Liu and Yupeng Shi and Jun Chen and Wei Rao and Shulin He and Andong Li and Yannan Wang and Zhiyong Wu},
journal= {arXiv preprint arXiv:2306.08454},
year = {2023}
}
备注
Accepted by InterSpeech 2023