中文

利用听觉启发特征从语音中联合估计混响时间与直达声与混响声比

声音 2015-10-16 v1

摘要

诸如混响时间 T60T_\mathrm{60} 和直达声与混响声比(DRR\mathrm{DRR})等房间声学参数的盲估计仍是一项具有挑战性的任务,尤其是从混响语音信号进行盲估计。本文提出一种新方法,用于在噪声条件下从宽带语音联合估计 T60T_\mathrm{60}DRR\mathrm{DRR}。利用排列成滤波器组的二维加博滤波器提取特征,随后将其作为多层感知机(MLP)的输入。MLP 输出神经元对应于特定的 (T60,DRR)(T_\mathrm{60}, \mathrm{DRR}) 估计对;输出随时间积分,并通过简单决策规则得出我们的估计。该方法应用于环境声学表征(ACE)挑战赛提供的单麦克风全带语音信号。我们的方法优于基线系统,T60T_\mathrm{60}DRR\mathrm{DRR} 估计的中位误差分别接近于零和 -1.5 dB,而估计计算速度比基线快 5.8 倍。

关键词

引用

@article{arxiv.1510.04620,
  title  = {Joint Estimation of Reverberation Time and Direct-to-Reverberation Ratio from Speech using Auditory-Inspired Features},
  author = {Feifei Xiong and Stefan Goetze and Bernd T. Meyer},
  journal= {arXiv preprint arXiv:1510.04620},
  year   = {2015}
}

备注

In Proceedings of the ACE Challenge Workshop - a satellite event of IEEE-WASPAA 2015 (arXiv:1510.00383)