DKU-MSXF 用于 VoxCeleb 说话人识别挑战赛 2023 的日记化系统
音频与语音处理
2023-08-21 v2
摘要
本文描述了 DKU-MSXF 对 VoxCeleb 说话人识别挑战赛 2023(VoxSRC-23)第 4 赛道的提交。我们的系统流程包含语音活动检测、基于聚类的日记化、重叠语音检测和目标说话人语音活动检测,其中每个步骤均有来自 3 个子模型的融合输出。最后,我们使用 DOVER-Lap 融合不同的基于聚类和基于 TSVAD 的日记化系统,取得了 4.30% 的日记化错误率(DER),在挑战赛排行榜第 4 赛道上排名第一。
引用
@article{arxiv.2308.07595,
title = {The DKU-MSXF Diarization System for the VoxCeleb Speaker Recognition Challenge 2023},
author = {Ming Cheng and Weiqing Wang and Xiaoyi Qin and Yuke Lin and Ning Jiang and Guoqing Zhao and Ming Li},
journal= {arXiv preprint arXiv:2308.07595},
year = {2023}
}