VoxSRC 2020: 第二届 VoxCeleb 说话人识别挑战赛
声音
2020-12-15 v1 机器学习
音频与语音处理
摘要
我们在 Interspeech 2020 期间举办了第二届 VoxCeleb 说话人识别挑战赛。该挑战赛的目标是评估当前说话人识别技术在无约束或“真实环境(in the wild)”数据中分离并识别说话人的能力。其内容包括:(i) 一个公开的来自 YouTube 视频的说话人识别与日记化(diarisation)数据集,附带真实标注和标准化的评估软件;以及 (ii) 在 Interspeech 2020 上举办的虚拟公开挑战赛与研讨会。本文概述了该挑战赛,并描述了基线、所使用的方法与结果。最后,我们结合第一届挑战赛讨论了所取得的进展。
引用
@article{arxiv.2012.06867,
title = {VoxSRC 2020: The Second VoxCeleb Speaker Recognition Challenge},
author = {Arsha Nagrani and Joon Son Chung and Jaesung Huh and Andrew Brown and Ernesto Coto and Weidi Xie and Mitchell McLaren and Douglas A Reynolds and Andrew Zisserman},
journal= {arXiv preprint arXiv:2012.06867},
year = {2020}
}