ID R&D VoxCeleb 说话人识别挑战赛 2023 系统描述
音频与语音处理
2023-08-22 v2
摘要
本报告描述了 ID R&D 团队提交至 VoxCeleb 说话人识别挑战赛 2023(VoxSRC-23)Track 2(开放赛道)的方案。我们的方案基于深度 ResNet 与自监督学习(SSL)模型的融合,这些模型在 VoxCeleb2 数据集与大规模 VoxTube 数据集的混合数据上训练。提交至 Track 2 的最终方案在 VoxSRC-23 公开排行榜上取得第一,minDCF(0.05) 为 0.0762,EER 为 1.30%。
引用
@article{arxiv.2308.08294,
title = {The ID R&D VoxCeleb Speaker Recognition Challenge 2023 System Description},
author = {Nikita Torgashov and Rostislav Makarov and Ivan Yakovlev and Pavel Malov and Andrei Balykin and Anton Okhotnikov},
journal= {arXiv preprint arXiv:2308.08294},
year = {2023}
}