中文

联合最小处理波束成形与近端聆听增强

音频与语音处理 2024-02-06 v2 声音

摘要

我们考虑在一个噪声环境中拾取、并须回放给另一噪声环境中听者的语音增强问题。对于远端噪声抑制与近端聆听增强,已有研究表明,在有利噪声条件(可懂度已处于上限水平)下,过度关注噪声抑制或可懂度最大化可能导致过度的语音失真与质量退化。近期[1,2]提出用最小处理框架来补救,该框架在仍满足特定可懂度准则的前提下,将噪声降低或聆听增强控制在最小量。此外,已有研究表明联合考虑两种环境可改善语音增强性能。本文中,我们构建了联合远端与近端最小处理框架,在有利噪声条件下提升可懂度的同时限制语音失真。我们给出了特定边界情形的闭式解,并利用数值优化研究了一般情形的性能。我们还表明,串联现有的最小处理远端与近端增强方法可保留初始方法的效果。结果显示,与串联方法相比,联合优化能进一步提升性能。

关键词

引用

@article{arxiv.2309.11243,
  title  = {Joint Minimum Processing Beamforming and Near-end Listening Enhancement},
  author = {Andreas J. Fuglsig and Jesper Jensen and Zheng-Hua Tan and Lars S. Bertelsen and Jens Christian Lindof and Jan Østergaard},
  journal= {arXiv preprint arXiv:2309.11243},
  year   = {2024}
}

备注

Accepted at IEEE ICASSP 2024 Workshop on Hands-free Speech Communication and Microphone Arrays (HSCMA) 2024