中文

用于城市声学场景分类的多设备数据集

音频与语音处理 2018-10-12 v2 声音

摘要

本文介绍了DCASE 2018挑战赛的声学场景分类任务以及为该任务提供的TUT Urban Acoustic Scenes 2018数据集,并评估了任务中基线系统的性能。如同往年挑战赛,该任务被定义为使用有监督、闭集分类设置将短音频片段分类至预定义声学场景类别之一。新录制的TUT Urban Acoustic Scenes 2018数据集包含十种不同的声学场景,并在六个欧洲大城市录制,因此其声学变异性高于此前用于该任务的数据集,且除高质量双耳录音外,还包括移动设备记录的数据。我们还给出了由卷积神经网络组成的基线系统及其在使用推荐交叉验证设置的子任务中的性能。

关键词

引用

@article{arxiv.1807.09840,
  title  = {A multi-device dataset for urban acoustic scene classification},
  author = {Annamaria Mesaros and Toni Heittola and Tuomas Virtanen},
  journal= {arXiv preprint arXiv:1807.09840},
  year   = {2018}
}

备注

accepted to DCASE 2018 Workshop