中文

基于单麦克风、若干乐高积木与非负矩阵分解的到达方向估计

音频与语音处理 2018-08-29 v3 声音

摘要

传统的声源定位方法至少需要两个麦克风。然而已知单侧听力损失者也能定位声音。单耳定位之所以可能,得益于头部的散射作用,尽管它依赖于学习各类声源频谱。受此人类能力的启发,我们提出利用嵌入任意散射结构中的单个麦克风进行精确声源定位的算法。该结构以方向相关的方式改变麦克风的频响,使每个方向具有特征签名。虽然已知这些签名足以定位白噪声源,但定位语音更具挑战性:这是一个不适定逆问题,我们通过以学习到的非负字典形式引入先验知识来进行正则化。我们展示了一种基于非负矩阵分解的单耳语音定位算法,其不依赖于精心设计的散射体。事实上,我们用由乐高积木制成的临时散射体给出了实验结果。即便使用这些简陋结构,我们也能准确本地化任意说话人;即我们无需为待定位的特定说话人学习字典。最后,我们讨论了多声源定位及其相关局限。

关键词

引用

@article{arxiv.1801.03740,
  title  = {Direction of Arrival with One Microphone, a few LEGOs, and Non-Negative Matrix Factorization},
  author = {Dalia El Badawy and Ivan Dokmanić},
  journal= {arXiv preprint arXiv:1801.03740},
  year   = {2018}
}

备注

This article has been accepted for publication in IEEE/ACM Transactions on Audio, Speech, and Language processing (TASLP)