基于单麦克风的移动机器人在混响环境下的声源定位
机器人学
2025-06-23 v1 声音
音频与语音处理
摘要
准确估计声源位置对于机器人语音识别至关重要。然而,现有的声源定位方法通常依赖至少两个空间预配置的麦克风的数组,这一要求限制了麦克风式机器人语音识别系统和技术的适用性。为缓解这些挑战,我们提出了一种利用移动机器人上安装的单麦克风在混响环境下进行在线声源定位的方法。具体而言,我们开发了一个仅包含 43k 参数的轻量级神经网络模型,通过提取混响信号中的时序信息来执行实时距离估计。估计得到的距离随后使用扩展卡尔曼滤波器,以实现在线声源定位。据我们所知,这是首个在移动机器人上使用单麦克风实现在线声源定位的工作,本文旨在填补这一空白。大量实验表明,我们的方法有效且具有优势。为利益更广泛的研究社区,我们已在 https://github.com/JiangWAV/single-mic-SSL 上开源代码。
引用
@article{arxiv.2506.16173,
title = {Single-Microphone-Based Sound Source Localization for Mobile Robots in Reverberant Environments},
author = {Jiang Wang and Runwu Shi and Benjamin Yen and He Kong and Kazuhiro Nakadai},
journal= {arXiv preprint arXiv:2506.16173},
year = {2025}
}
备注
This paper was accepted and going to appear in the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)