基于可微分 DSP 的实时音色重映射
声音
2024-07-08 v1 人工智能
机器学习
音频与语音处理
信号处理
摘要
音色是多样化音乐情境中主要的表达方式之一。然而,流行的音频驱动合成方法主要依赖音高和音量包络,实际上在消弭了来自输入的音色表达。我们的方法基于音色类比的概念,探讨了如何将来自输入信号的音色表达映射到合成器的控制上。利用可微分数字信号处理,我们的方法通过一种新颖的特征差异损失函数,直接优化合成器参数。这种损失函数旨在学习音乐事件之间的相对音色差异,优先考虑片段内分级音色调制的细微差异,允许在音色空间中进行有意义的翻译。以鼓面表演为案例研究,其中音色表达至关重要,我们展示了从声学鼓面到以 Roland TR-808 为模型的可微分合成器进行实时音色重映射。
引用
@article{arxiv.2407.04547,
title = {Real-time Timbre Remapping with Differentiable DSP},
author = {Jordie Shier and Charalampos Saitis and Andrew Robertson and Andrew McPherson},
journal= {arXiv preprint arXiv:2407.04547},
year = {2024}
}
备注
Accepted for publication at the 24th International Conference on New Interfaces for Musical Expression in Utrecht, Netherlands