同济大学团队参加 VoxCeleb 说话人识别挑战赛 2020
音频与语音处理
2020-10-19 v1 声音
摘要
在本报告中,我们描述了同济大学团队在 Interspeech 2020 的 VoxCeleb 说话人识别挑战赛(VoxSRC)2020 CLOSE 赛道上的提交。我们基于流行的 ResNet-34 架构研究了不同的说话人识别系统,并通过多种损失函数训练了多个变体。引入了离线与在线数据增强以提升训练集的多样性,并在后处理中应用了穷举网格搜索的分数归一化。我们为 CLOSE 赛道所选五个系统的最佳融合在挑战赛上取得了 0.2800 DCF 和 4.7770% EER。
引用
@article{arxiv.2010.08179,
title = {Tongji University Team for the VoxCeleb Speaker Recognition Challenge 2020},
author = {Rui Wang and Zhihua Wei and Yibin Zhan and Zhuoxi Chen},
journal= {arXiv preprint arXiv:2010.08179},
year = {2020}
}
备注
4 pages, 1 figures, interspeech workshop