中文

面向NIST SRE 2016的LIA系统描述

声音 2016-12-16 v1

摘要

本文描述了为说话人识别评测(SRE)活动开发的LIA说话人识别系统。开发了八个子系统,均基于最先进的方法:i-vector/PLDA,其代表了文本无关说话人识别的主流技术。这些子系统在以下方面有所不同:声学特征提取前端(MFCC、PLP)、i-vector提取阶段(UBM、DNN或双特征后验)以及最后的数据偏移(IDVC、均值偏移)。所提交的系统是这八个子系统在分数层面的融合。

关键词

引用

@article{arxiv.1612.05168,
  title  = {LIA system description for NIST SRE 2016},
  author = {Mickael Rouvier and Pierre-Michel Bousquet and Moez Ajili and Waad Ben Kheder and Driss Matrouf and Jean-François Bonastre},
  journal= {arXiv preprint arXiv:1612.05168},
  year   = {2016}
}