学习多声源二维定位
音频与语音处理
2020-12-11 v1 机器学习
声音
摘要
本文提出基于深度学习的新型算法用于多声源定位。具体而言,我们旨在利用多个麦克风阵列在封闭环境中找出多个声源的二维笛卡尔坐标。为此,我们使用编码-解码架构并提出两项改进以完成该任务。此外,我们还提出了两种新的定位表示法以提升精度。最后,基于分辨率的多声源关联开发了新指标,使我们能够评估和比较不同的定位方法。我们在合成数据与真实世界数据上测试了所提方法。结果表明,我们的方法优于此前该问题的基线方法。
引用
@article{arxiv.2012.05515,
title = {Learning Multiple Sound Source 2D Localization},
author = {Guillaume Le Moing and Phongtharin Vinayavekhin and Tadanobu Inoue and Jayakorn Vongkulbhisal and Asim Munawar and Ryuki Tachibana and Don Joven Agravante},
journal= {arXiv preprint arXiv:2012.05515},
year = {2020}
}
备注
Published in: 2019 IEEE 21st International Workshop on Multimedia Signal Processing (MMSP)