基于对象的音频中的对白增强——评估其对65岁以上人群的益处
音频与语音处理
2020-06-26 v1 声音
摘要
由于与年龄相关的听力损失,老年人常难以听清电视中的语言。由于他们占观众的比例不断增加,该问题在未来将更为重要,需由研发加以解决。基于对象的音频是解决此问题的一种有前景的方法,因其提供了可定制对白增强(DE)的可能性。本论文进行了调整/满意度测试(A/ST),以评估65岁以上人群中所偏好的语音与背景之间的响度差(LD)。测试了两类不同的DE:具有可分离可用音频组件(语音与背景)的DE,以及由盲源分离(BSS)创建的组件的DE。测试了相较于原始的偏好LD、两种DE方法间偏好LD的差异以及听众满意度。观察到偏好LD大于原始LD,可定制DE提升了听众满意度,且两种DE方法在偏好LD与听众满意度方面表现相当好。基于结果可假定,65岁以上的老年观众将从可用组件的用户可调DE和通过对白分离的DE中同等获益。
引用
@article{arxiv.2006.14282,
title = {Dialogue Enhancement in Object-based Audio -- Evaluating the Benefit on People above 65},
author = {Davide Straninger},
journal= {arXiv preprint arXiv:2006.14282},
year = {2020}
}