中文

基于帧频谱处理的可微分灰盒相位器效果建模

音频与语音处理 2023-06-05 v1 机器学习 声音

摘要

近年来,模拟模拟音频效果的机器学习方法得到了深入研究,特别是在吉他放大器等非线性时不变效果方面。然而,对于相位器等调制效果,由于存在控制效果缓慢时变特性的低频振荡器,新的挑战随之出现。现有方法要么需要该控制信号的先验知识,要么在实现上是非因果的。本工作提出了一种可微分数字信号处理方法来建模相位器效果,其中底层控制信号与效果的时变频谱响应被联合学习。所提模型以短帧处理音频,在频域实现时变滤波器,其传递函数基于典型的模拟相位器电路拓扑。我们表明该模型可被训练以仿真模拟参考设备,同时保留可解释且可调的参数。帧时长是所提模型的重要超参数,因此对其对模型精度的影响进行了研究。最优帧长取决于目标效果的速率与瞬态衰减时间,但帧长可在推理时更改而精度无显著变化。

关键词

引用

@article{arxiv.2306.01332,
  title  = {Differentiable Grey-box Modelling of Phaser Effects using Frame-based Spectral Processing},
  author = {Alistair Carson and Cassia Valentini-Botinhao and Simon King and Stefan Bilbao},
  journal= {arXiv preprint arXiv:2306.01332},
  year   = {2023}
}

备注

Accepted for publication in Proc. DAFx23, Copenhagen, Denmark, September 2023