BUT VOiCES 2019 系统描述
音频与语音处理
2019-07-16 v1 计算与语言
声音
摘要
本文描述了我们在 VOiCES 2019 说话人识别挑战赛中的工作。固定条件下的所有系统均基于 x-vector 范式,采用不同的特征与 DNN 拓扑结构。单个最佳系统达到 1.2% 的 EER,而 3 个系统的融合取得了 1.0% 的 EER,即相对提升 15%。开放条件允许我们使用外部数据,我们将其用于 PLDA 自适应,并取得了小于约 10% 的相对提升。在开放条件的提交中,我们使用了 3 个 x-vector 系统以及 1 个基于 i-vector 的系统。
引用
@article{arxiv.1907.06112,
title = {BUT VOiCES 2019 System Description},
author = {Hossein Zeinali and Pavel Matějka and Ladislav Mošner and Oldřich Plchot and Anna Silnova and Ondřej Novotný and Ján Profant and Ondřej Glembek and Lukáš Burget},
journal= {arXiv preprint arXiv:1907.06112},
year = {2019}
}