中文

AERO:谱域音频超分辨率

声音 2023-02-28 v2 机器学习 音频与语音处理

摘要

我们提出AERO,一种在谱域处理语音与音乐信号的音频超分辨率模型。AERO基于带有类U-Net跳跃连接的编码器-解码器架构。我们使用时域与频域损失函数联合优化模型。具体而言,我们考虑一组重构损失,以及以对抗与特征判别器损失函数形式出现的感知损失。为更好地处理相位信息,所提方法利用复值谱图,使用两个独立通道进行操作。与先前主要考虑低频与高频拼接的音频超分辨率工作不同,所提方法直接预测全频段。我们在涵盖语音与音乐的广泛采样率下展示了高性能。在Log-Spectral Distance、ViSQOL与主观MUSHRA测试上,AERO优于所评估的基线。音频样本与代码见 https://pages.cs.huji.ac.il/adiyoss-lab/aero

关键词

引用

@article{arxiv.2211.12232,
  title  = {AERO: Audio Super Resolution in the Spectral Domain},
  author = {Moshe Mandel and Or Tal and Yossi Adi},
  journal= {arXiv preprint arXiv:2211.12232},
  year   = {2023}
}