用于深度学习的感知音频损失函数
声音
2017-08-22 v1 机器学习
摘要
PESQ 和 POLQA 是人类所体验的语音质量自动评估标准。这些客观度量的预测值应尽可能接近主观听力测试中获得的主观质量评分。Wavenet 是最初作为原始音频波形深度生成模型开发的深度神经网络。Wavenet 架构基于膨胀因果卷积,具有极大的感受野。在本文中,我们建议使用 Wavenet 架构,特别是其大感受野,来学习 PESQ 算法。由此,我们可将其用作语音增强的可微损失函数。
引用
@article{arxiv.1708.05987,
title = {Perceptual audio loss function for deep learning},
author = {Dan Elbaz and Michael Zibulevsky},
journal= {arXiv preprint arXiv:1708.05987},
year = {2017}
}