中文

CochlScene:基于众包的声学场景数据获取

音频与语音处理 2022-11-07 v1 声音

摘要

本文描述了一种利用众包收集声学场景数据的流水线。我们解释了众包的详细流程,包括规划、验证标准以及实际的用户界面。作为数据收集的结果,我们提出了 CochlScene,一个用于声学场景分类的新数据集。我们的数据集由来自 13 个声学场景中 831 名参与者的 76k 个样本组成。我们还提出了训练集、验证集与测试集的手动数据划分,以提升评估结果的可靠性。最后,我们提供了一个供未来研究的基线系统。

关键词

引用

@article{arxiv.2211.02289,
  title  = {CochlScene: Acquisition of acoustic scene data using crowdsourcing},
  author = {Il-Young Jeong and Jeongsoo Park},
  journal= {arXiv preprint arXiv:2211.02289},
  year   = {2022}
}

备注

Accept by APSIPA ASC 2022, 5 pages, 2 figures