中文

无人机搜救音频数据集 DroneAudioset

音频与语音处理 2025-10-20 v1 人工智能 声音

摘要

无人机(Unmanned Aerial Vehicles, UAVs)在搜救任务中日益增多地用于检测人类存在。现有系统主要依赖视觉方法,但在低能见度或遮挡情况下容易失败。无人机音频感知具有前景,但因其自身噪声掩盖指示人类存在的声音。现有数据集要么在多样性上有限,要么为合成数据,缺乏真实声学互动,且缺乏无人机听觉的标准化 setup。为此,我们提出了DroneAudioset(该数据集已公开于https://huggingface.co/datasets/ahlab-drone-project/DroneAudioSet/下,采用MIT许可证),是一个综合性的无人机听觉数据集,包含23.5小时的标注录音,覆盖了从-57.2 dB到-2.5 dB的广泛信噪比(SNR),以及各种无人机类型、油门设置、麦克风配置和环境。该数据集支持开发和系统评估在挑战条件下噪声抑制和人类存在检测的方法,同时为无人机听觉系统的实际设计提供指导,如麦克风摆放权衡,以及开发无人机噪声感知音频处理。该数据集是实现无人机听觉系统设计和部署的重要一步。

关键词

引用

@article{arxiv.2510.15383,
  title  = {DroneAudioset: An Audio Dataset for Drone-based Search and Rescue},
  author = {Chitralekha Gupta and Soundarya Ramesh and Praveen Sasikumar and Kian Peen Yeo and Suranga Nanayakkara},
  journal= {arXiv preprint arXiv:2510.15383},
  year   = {2025}
}

备注

Accepted in Neurips (Datasets and Benchmarks Track) 2025. The first two authors are equal contributors