广播音频中的对话增强与聆听努力:一种多模态评估
音频与语音处理
2023-03-24 v2
摘要
对话增强(DE)在广播中起着至关重要的作用,它使得前景语音与背景音乐及音效之间的相对电平得以个性化。已有研究表明,DE能改善体验质量、可懂度以及自我报告的聆听努力(LE)。听觉学研究中已知LE的生理指标是瞳孔大小。瞳孔大小与LE之间的关系通常使用广播内容中不会遇到的人工语句和背景噪声进行研究。本工作以多模态方式评估DE对LE的影响,该方式包含瞳孔大小(由VR头显追踪)以及来自电视的真实音频片段。在理想聆听条件下,28名听力正常受试者以随机顺序收听30段音频片段,这些片段经过不同前景与背景音频相对电平的条件处理。其中一种条件采用近期提出的源分离系统,以原始混合信号为唯一输入来衰减背景。听完后,受试者被要求复述所听句子并自我报告LE。分析了平均瞳孔扩张与峰值瞳孔扩张,并与自我报告和词语回忆率进行比较。多模态评估显示出LE随背景电平降低而下降的一致趋势。DE,即便通过源分离实现,也显著减小瞳孔大小以及自我报告的LE。这凸显了用户端个性化功能的好处。
引用
@article{arxiv.2207.14240,
title = {Dialogue Enhancement and Listening Effort in Broadcast Audio: A Multimodal Evaluation},
author = {Matteo Torcoli and Thomas Robotham and Emanuël A. P. Habets},
journal= {arXiv preprint arXiv:2207.14240},
year = {2023}
}
备注
Paper accepted to 14th International Conference on Quality of Multimedia Experience (QoMEX), Lippstadt, Germany, 2022 - version 2 fixes some typos