面向案件工作条件下法庭自动说话人识别的 ECAPA-TDNN 系统验证
声音
2023-05-19 v1 音频与语音处理
摘要
基于时间延迟神经网络中的强调通道注意力、传播与聚合 (ECAPA-TDNN) 的法庭自动说话人识别 (FASR) 系统的不同变体,根据 forensic_eval_01 评估活动设置,在反映真实法庭语音比对案件条件的环境下进行了测试。使用这一近期神经模型作为嵌入提取模块,在嵌入层和分数层采用多种归一化策略,使我们能够观察到系统在判别力、准确率和精确率指标方面的性能变化。从所得结果可以表明,ECAPA-TDNN 可非常成功地用作 FASR 系统的基础组件,至少在所考虑的操作条件背景下能够超越先前的最先进水平。
引用
@article{arxiv.2305.10805,
title = {Validation of an ECAPA-TDNN system for Forensic Automatic Speaker Recognition under case work conditions},
author = {Francesco Sigona and Mirko Grimaldi},
journal= {arXiv preprint arXiv:2305.10805},
year = {2023}
}