AERO:谱域音频超分辨率
声音
2023-02-28 v2 机器学习
音频与语音处理
摘要
我们提出AERO,一种在谱域处理语音与音乐信号的音频超分辨率模型。AERO基于带有类U-Net跳跃连接的编码器-解码器架构。我们使用时域与频域损失函数联合优化模型。具体而言,我们考虑一组重构损失,以及以对抗与特征判别器损失函数形式出现的感知损失。为更好地处理相位信息,所提方法利用复值谱图,使用两个独立通道进行操作。与先前主要考虑低频与高频拼接的音频超分辨率工作不同,所提方法直接预测全频段。我们在涵盖语音与音乐的广泛采样率下展示了高性能。在Log-Spectral Distance、ViSQOL与主观MUSHRA测试上,AERO优于所评估的基线。音频样本与代码见 https://pages.cs.huji.ac.il/adiyoss-lab/aero
引用
@article{arxiv.2211.12232,
title = {AERO: Audio Super Resolution in the Spectral Domain},
author = {Moshe Mandel and Or Tal and Yossi Adi},
journal= {arXiv preprint arXiv:2211.12232},
year = {2023}
}