用于评估自动说话人验证公平性的差异性性能指标比较
音频与语音处理
2024-04-30 v1 声音
摘要
当决策被做出且个人数据由自动化过程处理时,人们期望公平性——即不同人口群体的成员获得公平对待。这种期望适用于自动说话人验证(ASV)等生物识别系统。我们比较了三种候选公平性指标,并通过检查一系列不同 ASV 操作点上的差异性性能,扩展了先前针对人脸识别所做的工作。结果表明,生物识别公平性的基尼聚合率(GARBE)是唯一满足三个功能性公平性度量标准的指标。此外,还提出了五种 SOTA ASV 系统的公平性和验证性能的综合评估。我们的发现揭示了公平性和验证准确性之间微妙的权衡,强调了系统设计、人口包容性和验证可靠性之间复杂的相互作用。
引用
@article{arxiv.2404.17810,
title = {A Comparison of Differential Performance Metrics for the Evaluation of Automatic Speaker Verification Fairness},
author = {Oubaida Chouchane and Christoph Busch and Chiara Galdi and Nicholas Evans and Massimiliano Todisco},
journal= {arXiv preprint arXiv:2404.17810},
year = {2024}
}
备注
8 pages, 7 figures