DKU-DukeECE用于VoxCeleb说话人识别挑战赛2022的日记化系统
音频与语音处理
2022-10-05 v1
摘要
本文描述了DKU-DukeECE提交至VoxCeleb说话人识别挑战赛2022(VoxSRC-22)第4赛道的结果。我们的系统包含一个融合的语音活动检测模型、一个基于聚类的日记化模型,以及一个基于目标说话人语音活动检测的重叠检测模型。总体而言,所提交系统与我们在VoxSRC-21中的上年系统相似。不同之处在于我们使用了性能更好的说话人嵌入和融合的语音活动检测,显著提升了性能。最后,我们使用DOVER-lap融合4个不同系统,取得了4.75的日记化错误率,在第4赛道中排名第一。
引用
@article{arxiv.2210.01677,
title = {The DKU-DukeECE Diarization System for the VoxCeleb Speaker Recognition Challenge 2022},
author = {Weiqing Wang and Xiaoyi Qin and Ming Cheng and Yucong Zhang and Kangyue Wang and Ming Li},
journal= {arXiv preprint arXiv:2210.01677},
year = {2022}
}
备注
arXiv admin note: substantial text overlap with arXiv:2109.02002