中文

FADI-AEC:由远端信号引导的基于分数的快速扩散模型用于声学回声消除

音频与语音处理 2024-01-10 v1 声音

摘要

尽管扩散模型在语音增强方面具有潜力,但其在声学回声消除 (AEC) 中的部署受到限制。在本文中,我们提出了 DI-AEC,开创了一种专用于 AEC 的基于扩散的随机再生方法。此外,我们提出了 FADI-AEC,这是一种基于分数的快速扩散 AEC 框架,旨在节省计算需求,使其适用于边缘设备。其突出特点是每帧仅运行一次分数模型,实现了处理效率的显著提升。除此之外,我们引入了一种新颖的噪声生成技术,利用远端信号,结合远端和近端信号以提高分数模型的准确性。我们在 ICASSP2023 微软深度回声消除挑战评估数据集上测试了我们提出的方法,结果显示我们的方法优于一些端到端方法和其他基于扩散的回声消除方法。

关键词

引用

@article{arxiv.2401.04283,
  title  = {FADI-AEC: Fast Score Based Diffusion Model Guided by Far-end Signal for Acoustic Echo Cancellation},
  author = {Yang Liu and Li Wan and Yun Li and Yiteng Huang and Ming Sun and James Luan and Yangyang Shi and Xin Lei},
  journal= {arXiv preprint arXiv:2401.04283},
  year   = {2024}
}