声音事件检测系统的后处理无关评估
音频与语音处理
2023-06-28 v1 声音
摘要
由于声音事件检测(SED)系统应用需求的高度差异性,仅以单一运行模式评估系统是不够的。因此,社区近期采用了复调声音检测分数(PSDS)作为评估指标,其为 PSD 接收者操作特征(PSD-ROC)下的归一化面积。它汇总了由改变决策阈值(用于将系统输出分数转换为二值检测输出)所产生的多种运行模式下的系统性能。因而,它提供了更完整的系统整体行为图景,且较少受特定阈值调优的偏倚。然而,除决策阈值外,还可改变后处理以进入另一运行模式。本文中,我们提出后处理无关 PSDS(piPSDS)作为 PSDS 的推广。此处,后处理无关 PSD-ROC 包含了来自不同后处理与不同决策阈值的运行点。因此,它汇总了 SED 系统更多的运行模式,并允许在不需实现后处理且不受不同后处理偏倚的情况下进行系统比较。虽然 piPSDS 原则上可结合不同类型后处理,作为第一步,我们给出了今年 DCASE Challenge Task4a 系统的中值滤波无关 PSDS(miPSDS)结果。源代码已在我们的 sed_scores_eval 包中公开(https://github.com/fgnt/sed_scores_eval)。
引用
@article{arxiv.2306.15440,
title = {Post-Processing Independent Evaluation of Sound Event Detection Systems},
author = {Janek Ebbers and Reinhold Haeb-Umbach and Romain Serizel},
journal= {arXiv preprint arXiv:2306.15440},
year = {2023}
}
备注
submitted to DCASE Workshop 2023