矢量量化与协方差矩阵相结合用于说话人识别
声音
2022-03-24 v1 密码学与安全
音频与语音处理
摘要
本文提出了一种基于经典矢量量化(VQ)与协方差矩阵(CM)方法相结合的说话人识别新算法。VQ-CM 组合方法以可比的计算负担改善了每种方法单独的识别率。它提供了一种直接的过程来获得类似于具有全协方差矩阵的 GMM 的模型。实验结果还表明,相较于单独的 VQ 或 CM,它对噪声更具鲁棒性。
引用
@article{arxiv.2203.12306,
title = {A combination between VQ and covariance matrices for speaker recognition},
author = {Marcos Faundez-Zanuy},
journal= {arXiv preprint arXiv:2203.12306},
year = {2022}
}
备注
5 pages, published in 2001 IEEE International Conference on Acoustics, Speech, and Signal Processing. Proceedings (Cat. No.01CH37221), Salt Lake City, UT, USA