中文

Diff-MSTC:面向Cubase的混音风格迁移原型系统

音频与语音处理 2024-11-12 v1 声音

摘要

在我们的演示中,参与者被邀请探索Diff-MSTC原型,该原型将Diff-MST模型集成到Steinberg的数字音频工作站(DAW)Cubase中。Diff-MST是一种用于混音风格迁移的深度学习模型,可根据参考歌曲预测音轨的调音台参数。该系统处理多达20条原始音轨以及一首参考歌曲,预测可用于创建初始混音的调音台参数。用户可以手动进一步调整这些参数以获得更大的控制力。与此前仅限于研究思路的深度学习系统不同,Diff-MSTC是首个集成到DAW中的原型系统。这一集成促进了多轨混音决策,并允许用户通过参考歌曲输入上下文,再以传统方式微调音频效果。

关键词

引用

@article{arxiv.2411.06576,
  title  = {Diff-MSTC: A Mixing Style Transfer Prototype for Cubase},
  author = {Soumya Sai Vanka and Lennart Hannink and Jean-Baptiste Rolland and George Fazekas},
  journal= {arXiv preprint arXiv:2411.06576},
  year   = {2024}
}

备注

Presented at 2024 International Society for Music Information Retrieval