中文

DKU-DukeECE-Lenovo系统用于2021 VoxCeleb说话人识别挑战赛的日记化任务

音频与语音处理 2021-09-08 v2 声音

摘要

本报告描述了DKU-DukeECE-Lenovo团队向VoxCeleb说话人识别挑战赛(VoxSRC)2021 track 4的提交。我们的系统包括一个语音活动检测(VAD)模型、一个说话人嵌入模型、两个具有不同相似度度量的基于聚类的说话人日记化系统、两个不同的重叠语音检测(OSD)模型,以及一个目标说话人语音活动检测(TS-VAD)模型。我们的最终提交由5个独立系统组成,在挑战测试集上取得了5.07%的DER。

关键词

引用

@article{arxiv.2109.02002,
  title  = {The DKU-DukeECE-Lenovo System for the Diarization Task of the 2021 VoxCeleb Speaker Recognition Challenge},
  author = {Weiqing Wang and Danwei Cai and Qingjian Lin and Lin Yang and Junjie Wang and Jin Wang and Ming Li},
  journal= {arXiv preprint arXiv:2109.02002},
  year   = {2021}
}