基于混合模型的语音无监督去混响
声音
2025-10-13 v1 人工智能
音频与语音处理
摘要
本文提出了一种新的训练策略,仅使用混响语音以无监督方式改进语音去混响系统。大多数现有算法依赖成对的干声/混响数据,而这类数据难以获取。我们的方法利用有限的声学信息,如混响时间(RT60),来训练去混响系统。实验结果表明,我们的方法在各种客观指标上比最先进(SOTA)方法取得了更一致的性能。
引用
@article{arxiv.2510.09025,
title = {D\'er\'everb\'eration non-supervis\'ee de la parole par mod\`ele hybride},
author = {Louis Bahrman and Mathieu Fontaine and Gaël Richard},
journal= {arXiv preprint arXiv:2510.09025},
year = {2025}
}
备注
in French language