用于音频时间拉伸的噪声变形
音频与语音处理
2023-12-25 v1 声音
摘要
本文介绍了一种创新方法,通过将声音精确分解为正弦波、瞬态和噪声,并改进对后一分量的处理,来提高音频时间拉伸的质量。虽然已有高质量时间拉伸正弦波和瞬态的成熟方法,但先前研究中缺乏对噪声或残差分量的稳健处理方案。所提出的方法将声音分解与先前的音频频谱再合成技术相结合。时间拉伸的噪声分量通过将其时间插值的频谱幅度与白噪声激励信号进行变形来实现。该方法以其简单性、高效性和音频质量而著称。主观实验的结果证实了该方法在所有评估的拉伸因子下均优于当前最先进的方法。所提出的技术尤其在极端拉伸场景中表现出色,标志着性能的显著提升。该方法有望广泛应用于慢动作媒体内容,如音乐或体育视频制作。
引用
@article{arxiv.2312.14586,
title = {Noise Morphing for Audio Time Stretching},
author = {Eloi Moliner and Leonardo Fierro and Alec Wright and Matti Hämäläinen and Vesa Välimäki},
journal= {arXiv preprint arXiv:2312.14586},
year = {2023}
}
备注
submitted to IEEE Signal Processing Letters