中文

面向文本依赖说话人验证的 SVASR 系统: AAIC Challenge 2024

声音 2024-11-26 v1 人工智能 音频与语音处理

摘要

本文介绍了一个高效且准确的文本依赖说话人验证 (TDSV) 管道, 以满足高性能生物识别系统的需求。该系统采用基于 Fast-Conformer 的 ASR 模块来验证语音内容, 过滤掉 Target-Wrong (TW) 和 Impostor-Wrong (IW) 试验。对于说话人验证, 我们提出了一种特征融合方法, 将从 wav2vec-BERT 和 ReDimNet 模型中提取的说话人嵌入组合创建统一的说话人表示。该系统在 TDSV 2024 挑战测试集上取得了竞争的结果, 归一化 min-DCF 为 0.0452 (排名第 2), 凸显其在准确性和鲁棒性之间取得平衡的效果。

关键词

引用

@article{arxiv.2411.16276,
  title  = {The SVASR System for Text-dependent Speaker Verification (TdSV) AAIC Challenge 2024},
  author = {Mohammadreza Molavi and Reza Khodadadi},
  journal= {arXiv preprint arXiv:2411.16276},
  year   = {2024}
}