神经网络语音生成中的背景噪声处理
音频与语音处理
2021-02-25 v1 声音
摘要
近年来基于神经网络的语音生成建模在语音编码方面展现出巨大潜力。然而,当输入并非干净语音时(例如存在背景噪声),此类模型的性能会下降,从而阻碍其在实际应用中的使用。本文中我们探究其原因并讨论克服该问题的方法。研究表明,在训练期间提取特征和目标干净语音时放置去噪预处理阶段是性能最佳的策略。
引用
@article{arxiv.2102.11906,
title = {Handling Background Noise in Neural Speech Generation},
author = {Tom Denton and Alejandro Luebs and Felicia S. C. Lim and Andrew Storus and Hengchin Yeh and W. Bastiaan Kleijn and Jan Skoglund},
journal= {arXiv preprint arXiv:2102.11906},
year = {2021}
}
备注
5 pages, 3 figures, presented at the Asilomar Conference on Signals, Systems, and Computers 2020