SpeakIn 系统在 VoxCeleb 说话人识别挑战赛 2021 中的方案
声音
2021-09-07 v1 音频与语音处理
摘要
本报告描述了我们提交至 VoxCeleb 说话人识别挑战赛 2021(VoxSRC 2021)的 track 1 与 track 2 的方案。track 1 与 track 2 共用同一说话人验证系统,该系统仅使用 VoxCeleb2-dev 作为训练集。本报告探讨了若干部分,包括数据增强、网络结构、基于域的大间隔微调与后端精炼。我们的系统为 9 个模型的融合,并在 VoxSRC 2021 的这两个赛道中取得第一。我们提交结果的 minDCF 为 0.1034,相应的 EER 为 1.8460%。
引用
@article{arxiv.2109.01989,
title = {The SpeakIn System for VoxCeleb Speaker Recognition Challange 2021},
author = {Miao Zhao and Yufeng Ma and Min Liu and Minqiang Xu},
journal= {arXiv preprint arXiv:2109.01989},
year = {2021}
}
备注
Submitted to INTERSPEECH2021 VoxSRC2021 Workshop