面向NIST SRE 2016的LIA系统描述
声音
2016-12-16 v1
摘要
本文描述了为说话人识别评测(SRE)活动开发的LIA说话人识别系统。开发了八个子系统,均基于最先进的方法:i-vector/PLDA,其代表了文本无关说话人识别的主流技术。这些子系统在以下方面有所不同:声学特征提取前端(MFCC、PLP)、i-vector提取阶段(UBM、DNN或双特征后验)以及最后的数据偏移(IDVC、均值偏移)。所提交的系统是这八个子系统在分数层面的融合。
引用
@article{arxiv.1612.05168,
title = {LIA system description for NIST SRE 2016},
author = {Mickael Rouvier and Pierre-Michel Bousquet and Moez Ajili and Waad Ben Kheder and Driss Matrouf and Jean-François Bonastre},
journal= {arXiv preprint arXiv:1612.05168},
year = {2016}
}