中文

HiFi-Stream:基于生成对抗网络的流式语音增强

声音 2025-07-24 v2 机器学习 音频与语音处理

摘要

语音增强技术已成为移动设备和语音软件中的核心技术。然而,现代深度学习解决方案通常需要大量的计算资源,这使得在资源受限的设备上使用具有挑战性。我们提出了HiFi-Stream,这是最近发布的HiFi++模型的优化版本。我们的实验表明,尽管其规模和计算复杂度相较于原始HiFi++模型有所提升,但HiFi-Stream在大多数质量方面保持了原始模型的大部分性能,使其成为目前最小且最快的模型之一。在流式设置下进行评估,HiFi-Stream显示出比现代基准模型更优的性能。

关键词

引用

@article{arxiv.2503.17141,
  title  = {HiFi-Stream: Streaming Speech Enhancement with Generative Adversarial Networks},
  author = {Ekaterina Dmitrieva and Maksim Kaledin},
  journal= {arXiv preprint arXiv:2503.17141},
  year   = {2025}
}

备注

5 pages (4 content pages + 1 page of references)