The Orchive:挖掘大规模生物声学档案
机器学习
2013-07-03 v1 数据库
声音
摘要
The Orchive 是一个大型集合,包含来自位于温哥华岛北端附近的 OrcaLab 研究设施的超过 20,000 小时的音频录音。它收录了从 1980 年至今的虎鲸发声录音,是世界上最大的生物声学数据资源之一。我们开发了一个基于网络的界面,允许研究人员收听这些录音,查看音频的波形和频谱表示,用注释标记片段,并查看基于自动音频特征提取的机器学习分类器的结果。在本文中,我们描述了此类分类器,它们能够区分背景噪声、虎鲸叫声以及大多数磁带中存在的语音备注。此外,我们展示了基于先前存在的虎鲸叫声目录的单个叫声的分类结果。我们还实验性地研究了分类器在整个 Orchive 上的可扩展性。
引用
@article{arxiv.1307.0589,
title = {The Orchive : Data mining a massive bioacoustic archive},
author = {Steven Ness and Helena Symonds and Paul Spong and George Tzanetakis},
journal= {arXiv preprint arXiv:1307.0589},
year = {2013}
}
备注
ICML 2013 Workshop on Machine Learning for Bioacoustics