中文

面向年龄无关的稳健说话人验证系统

音频与语音处理 2025-08-05 v1

摘要

在说话人验证 (SV) 中,儿童和成年人语音之间的声学不匹配,导致在应用成年人训练的说话人验证系统进行儿童说话人验证 (C-SV) 时性能 suboptimal。虽然域适应技术可以增强 C-SV 任务的性能,但往往以在成年人说话人验证 (A-SV) 任务上显著降低性能为代价。本研究提出了一种年龄无关说话人验证 (AASV) 系统,实现了在 C-SV 和 A-SV 任务中均稳健的性能。我们的方法采用域分类器来解耦语音中的年龄相关属性,随后利用提取的域信息扩展嵌入空间,形成一种跨年龄组均稳健且高度判别的统一说话人表征。在 OGI 和 VoxCeleb 数据集上的实验表明,我们的方法在弥合 SV 性能差距方面有效,为构建包容且面向年龄适应的 SV 系统奠定了基础。

关键词

引用

@article{arxiv.2508.01637,
  title  = {An Age-Agnostic System for Robust Speaker Verification},
  author = {Jiusi Zheng and Vishwas Shetty and Natarajan Balaji Shankar and Abeer Alwan},
  journal= {arXiv preprint arXiv:2508.01637},
  year   = {2025}
}

备注

Accepted to the Interspeech 2025 Workshop on Child Computer Interaction