中文

对抗网络与经典语音增强技术的比较研究

音频与语音处理 2019-10-22 v1 机器学习

摘要

语音增强对于若干应用是一项关键任务。最受探索的技术包括维纳滤波器和 LogMMSE,但适用于该任务的深度学习方法(如 SEGAN)已展现出相关成果。本研究在 85 种噪声条件下就质量、可懂度和失真比较了上述技术的性能;并得出结论:经典技术在大多数场景下仍表现出更优结果,但在严重噪声场景下,SEGAN 表现更好且方差更低。

关键词

引用

@article{arxiv.1910.09522,
  title  = {Comparative Study between Adversarial Networks and Classical Techniques for Speech Enhancement},
  author = {Tito Spadini and Ricardo Suyama},
  journal= {arXiv preprint arXiv:1910.09522},
  year   = {2019}
}