一种基于模糊逻辑的新型音频质量评估指标:客观音频质量评估
音频与语音处理
2019-10-31 v1 声音
信号处理
摘要
ITU-R BS.1387 规定了一种感知音频质量客观评估的方法。该建议书也称为 PEAQ(Perceptual Evaluation of Audio Quality,感知音频质量评估),基于人耳的心理声学模型,并由国际电信联盟标准化,作为主观测试(昂贵且耗时的过程)的替代方案。PEAQ 结合人耳的多种生理与心理声学特性,给出参考音频与测试音频之间质量差异的度量。参考音频信号可视为无失真源,而测试信号是参考信号的失真版本,可能因压缩而产生可听伪像。该算法计算模型输出变量(Model Output Variables, MOVs),并使用三层感知机人工神经网络将其映射为单一质量度量——客观差异等级(Objective Difference Grade, ODG)。ODG 估计两个音频信号之间的感知失真。本文提出一种计算复杂度低的新型指标 FQI(Fuzzy Quality Index,模糊质量指数),其基于模糊逻辑推理,并已融入现有 PEAQ 模型以提升整体性能。结果表明改进版略优于 PEAQ。
引用
@article{arxiv.1910.13571,
title = {A novel fuzzy logic-based metric for audio quality assessment: Objective audio quality assessment},
author = {Luis F. Abanto-Leon and Guillermo Kemper Vasquez and Joel Telles},
journal= {arXiv preprint arXiv:1910.13571},
year = {2019}
}