车辆噪声环境下的基于音频的行人检测
音频与语音处理
2025-09-24 v1 人工智能
机器学习
声音
摘要
基于音频的行人检测是一项具有挑战性的任务,迄今为止仅在噪声受限的环境中进行过探索。本文提出了一个新的数据集、结果,并对车辆噪声环境下基于音频的行人检测的最新技术进行了详细分析。在我们的研究中,我们进行了三项分析:(i) 噪声环境与噪声受限环境之间的跨数据集评估,(ii) 评估噪声数据对模型性能的影响,重点揭示声学上下文的影响,以及 (iii) 评估模型对域外声音的预测鲁棒性。这个新数据集是一个全面的 1321 小时路侧数据集,包含了交通密集的声景。每条录音包含 16kHz 音频,并同步提供帧级行人标注和 1fps 视频缩略图。
引用
@article{arxiv.2509.19295,
title = {Audio-Based Pedestrian Detection in the Presence of Vehicular Noise},
author = {Yonghyun Kim and Chaeyeon Han and Akash Sarode and Noah Posner and Subhrajit Guhathakurta and Alexander Lerch},
journal= {arXiv preprint arXiv:2509.19295},
year = {2025}
}
备注
Accepted to the 10th Workshop on Detection and Classification of Acoustic Scenes and Events (DCASE), 2025