中文

基于连续描述符的深度音频合成控制

声音 2023-02-28 v1 机器学习 音频与语音处理

摘要

尽管深度音乐生成模型取得了显著进展,这些技术的应用仍局限于专家用户。在面向音乐人普及之前,生成模型必须首先对生成提供富有表现力的控制,因为这决定了深度生成模型在创作工作流中的集成。本文中,我们通过引入一种提供富有表现力且基于连续描述符控制的深度生成音频模型来解决此问题,同时其轻量到足以嵌入硬件合成器中。我们通过使用对抗混淆准则在潜空间中显式移除显著音乐特征,来强化实时生成的可控性。随后将用户指定特征作为额外条件信息重新引入,从而实现类似于合成器旋钮的连续生成控制。我们在包括器乐、打击乐与语音录音的广泛声音上评估了方法性能,同时提供音色与属性迁移,开启了声音生成的新方式。

关键词

引用

@article{arxiv.2302.13542,
  title  = {Continuous descriptor-based control for deep audio synthesis},
  author = {Ninon Devis and Nils Demerlé and Sarah Nabi and David Genova and Philippe Esling},
  journal= {arXiv preprint arXiv:2302.13542},
  year   = {2023}
}

备注

ICASSP 2023