中文

ID R&D VoxCeleb 说话人识别挑战赛 2023 系统描述

音频与语音处理 2023-08-22 v2

摘要

本报告描述了 ID R&D 团队提交至 VoxCeleb 说话人识别挑战赛 2023(VoxSRC-23)Track 2(开放赛道)的方案。我们的方案基于深度 ResNet 与自监督学习(SSL)模型的融合,这些模型在 VoxCeleb2 数据集与大规模 VoxTube 数据集的混合数据上训练。提交至 Track 2 的最终方案在 VoxSRC-23 公开排行榜上取得第一,minDCF(0.05) 为 0.0762,EER 为 1.30%。

关键词

引用

@article{arxiv.2308.08294,
  title  = {The ID R&D VoxCeleb Speaker Recognition Challenge 2023 System Description},
  author = {Nikita Torgashov and Rostislav Makarov and Ivan Yakovlev and Pavel Malov and Andrei Balykin and Anton Okhotnikov},
  journal= {arXiv preprint arXiv:2308.08294},
  year   = {2023}
}