中文

面向正常听力与听力受损听众的双耳音频质量预测

音频与语音处理 2025-12-05 v1

摘要

Eurich 等人(2024)最近提出了一种计算效率高的单声道和双声道音频质量模型(eMoBi-Q)。该模型整合了单声道和双声道听觉特征,并通过六个音频数据集进行验证,这些数据集包含针对音乐和语音的质量评级,语音通过算法处理,这些算法在现代听力设备中常见(例如声学透明度、反馈消除和双声道波束成形)或通过扬声器呈现。在本研究中,我们扩展eMoBi-Q以account for听力受损(HL)对音频质量的感知效应。为此,该模型通过一个非线性听觉滤波器进行扩展。鉴于altered loudness感知是听力受损听众中常见的问题,我们的目标是将loudness作为预测正常听力和听力受损人群中音频质量的子维度。虽然预测loudness本身在基于loudness的听力助听器拟合背景下很重要,但loudness作为音频质量子措施可能有助于选择可靠的听力受损听众的听觉特征。滤波器及后续处理阶段的参数由Pieper等人(2018)提出的基于生理学(双声道)loudness模型所inform。本研究提出并讨论了扩展后双声道质量模型的初始实现。

关键词

引用

@article{arxiv.2512.04792,
  title  = {Towards predicting binaural audio quality in listeners with normal and impaired hearing},
  author = {Thomas Biberger and Stephan D. Ewert},
  journal= {arXiv preprint arXiv:2512.04792},
  year   = {2025}
}

备注

accepted for publication in Forum Acusticum