用于时变音频系统的可微全极点滤波器
音频与语音处理
2024-10-22 v4 机器学习
声音
摘要
无限脉冲响应滤波器是许多时变音频系统(如音频效果器和合成器)的基本构建模块。然而,其递归结构阻碍了使用自动微分对这些系统进行端到端训练。尽管先前的工作中已提出并广泛使用了非递归滤波器近似方法(如频率采样和基于帧的处理),但它们无法准确反映原始系统的梯度。我们通过重新表达时变全极点滤波器以使其通过自身反向传播梯度来缓解这一困难,从而使滤波器的实现不受自动微分框架技术限制的约束。该实现可用于包含极点滤波器的音频系统中,以实现高效的梯度评估。我们在相位器、时变减法合成器和压缩器上展示了其对真实世界动态音频系统的训练效率和表达能力。我们公开了代码和音频样本,并在 https://diffapf.github.io/web/ 以 VST 插件形式提供了训练好的音频效果器和合成器模型。
引用
@article{arxiv.2404.07970,
title = {Differentiable All-pole Filters for Time-varying Audio Systems},
author = {Chin-Yun Yu and Christopher Mitcheltree and Alistair Carson and Stefan Bilbao and Joshua D. Reiss and György Fazekas},
journal= {arXiv preprint arXiv:2404.07970},
year = {2024}
}
备注
Published at DAFx 2024