Phonexia VoxCeleb 说话人识别挑战赛 2021 系统描述
声音
2021-09-09 v3 机器学习
音频与语音处理
摘要
我们描述了 Phonexia 在 VoxCeleb 说话人识别挑战赛 2021(VoxSRC-21)无监督说话人验证赛道中的提交方案。我们的解决方案与 IDLab 在 VoxSRC-20 中的获奖方案非常相似。嵌入提取器使用动量对比学习进行引导,以输入增强作为唯一的监督来源。随后进行若干次聚类迭代以分配伪说话人标签,这些标签随后用于有监督的嵌入提取器训练。最后,通过对五个不同嵌入提取器的 zt 归一化余弦分数取平均完成分数融合。我们也简要描述了使用 i-vector 替代 DNN 嵌入以及 PLDA 替代余弦打分的失败方案。
引用
@article{arxiv.2109.02052,
title = {The Phonexia VoxCeleb Speaker Recognition Challenge 2021 System Description},
author = {Josef Slavíček and Albert Swart and Michal Klčo and Niko Brümmer},
journal= {arXiv preprint arXiv:2109.02052},
year = {2021}
}
备注
Second place in the self-supervised track of VoxSRC-21: VoxCeleb Speaker Recognition Challenge