面向重叠多说话人说话人验证的目标说话人提取
音频与语音处理
2019-02-08 v1 声音
摘要
当测试语音受到干扰说话人污染时,说话人验证的性能会显著下降。若各说话人在时间上不重叠,说话人日志(speaker diarization)能很好地分离说话人。然而,若多个说话人同时讲话,我们需要能够在频谱域分离语音的技术。本文提出一种利用目标说话人提取方法的重叠多说话人说话人验证框架。具体而言,在给定目标说话人信息后,首先由目标说话人提取模块从重叠多说话人语音中提取出目标说话人的语音;随后,将提取出的语音送入说话人验证系统。实验结果表明,所提方法显著提升了重叠多说话人说话人验证的性能,并实现了 65.7% 的相对等错误率(EER)降低。
引用
@article{arxiv.1902.02546,
title = {Target Speaker Extraction for Overlapped Multi-Talker Speaker Verification},
author = {Wei Rao and Chenglin Xu and Eng Siong Chng and Haizhou Li},
journal= {arXiv preprint arXiv:1902.02546},
year = {2019}
}
备注
5 pages, 3 figures. This paper is submitted to Interspeech 2019