中文

面向声音事件检测的众包强标签获取

音频与语音处理 2021-07-27 v1

摘要

强标签是评估声音事件检测方法所必需的,但由于标注任务所需资源高昂,往往稀缺。我们提出了一种利用众包弱标签估计强标签的方法,该方法将标注任务划分为简单的单元任务。基于对标注者能力的估计,对弱标签进行聚合与处理,得到一组客观的强标签。实验使用合成音频,通过与真实标注对比来验证所得标注的质量。所提方法生成的标签精度高,但并非所有事件实例都被召回。将所得标注与真实标注进行比较的检测指标显示,在 1 秒片段上 F 值为 80%,按复调声音检测评分指标计算的交叉基 F1 分数最高达 89.5%。

关键词

引用

@article{arxiv.2107.12089,
  title  = {Crowdsourcing strong labels for sound event detection},
  author = {Irene Martín-Morató and Manu Harju and Annamaria Mesaros},
  journal= {arXiv preprint arXiv:2107.12089},
  year   = {2021}
}