中山大学系统用于Interspeech 2015自动说话人验证欺骗与对策挑战赛
声音
2015-07-30 v2 计算与语言
摘要
据报道,许多现有的说话人验证系统易受多种欺骗攻击,例如说话人自适应语音合成、语音转换、回放等。为检测这些欺骗语音信号作为对策,我们提出了一种融合多个不同i-vector子系统的得分层融合方法。我们表明,声学层的梅尔频率倒谱系数(MFCC)特征、相位层的修正群延迟倒谱系数(MGDCC)以及音素层的音素后验概率(PPP)串联特征对于对策是有效的。此外,在i-vector建模之前对这些特征进行特征层融合也能提升性能。采用多项式核支持向量机作为有监督分类器。为增强对策的泛化能力,我们还采用了余弦相似度和PLDA评分作为单类分类方法。通过将所提出的i-vector子系统与覆盖声学和韵律信息的OpenSMILE基线相结合,进一步提升了最终性能。所提出的融合系统在INTERSPEECH 2015自动说话人验证欺骗与对策挑战赛提供的数据库的开发集和测试集上分别达到了0.29%和3.26%的等错误率(EER)。
引用
@article{arxiv.1507.06711,
title = {The SYSU System for the Interspeech 2015 Automatic Speaker Verification Spoofing and Countermeasures Challenge},
author = {Shitao Weng and Shushan Chen and Lei Yu and Xuewei Wu and Weicheng Cai and Zhi Liu and Ming Li},
journal= {arXiv preprint arXiv:1507.06711},
year = {2015}
}
备注
5 pages, 1 figure