Speed 团队在 DIHARD II 中的提交:贡献与经验教训
音频与语音处理
2019-11-07 v1 机器学习
声音
摘要
本文描述了 Speed 团队为第二届 DIHARD 语音日记化挑战赛(DIHARD II)开发的说话人日记化系统。除描述该显著优于挑战赛基线的系统外,我们还聚焦于从为单通道与多通道系统尝试的众多方法中获得的经验教训。我们展示了日记化系统的若干组件,包括领域分类、语音增强、语音活动检测、说话人嵌入、聚类方法、重分割以及系统融合。我们在挑战赛的真实设置下分析并讨论了各此类组件对整体日记化性能的影响。
引用
@article{arxiv.1911.02388,
title = {The Speed Submission to DIHARD II: Contributions & Lessons Learned},
author = {Md Sahidullah and Jose Patino and Samuele Cornell and Ruiqing Yin and Sunit Sivasankaran and Hervé Bredin and Pavel Korshunov and Alessio Brutti and Romain Serizel and Emmanuel Vincent and Nicholas Evans and Sébastien Marcel and Stefano Squartini and Claude Barras},
journal= {arXiv preprint arXiv:1911.02388},
year = {2019}
}