面向表达性小提琴演奏的合成研究:方法与比较
声音
2024-06-27 v1 多媒体
音频与语音处理
摘要
小提琴演奏的表达音乐合成 (EMS) 具有挑战性,主要源于音乐演奏者对表达音乐术语 (EMTs) 的解释存在分歧,缺乏标注录音,以及合成模型的泛化能力有限。这些挑战在模型有效性、生成结果的多样性以及合成系统的可控性之间制造了权衡,使得对 EMS 模型设计进行比较研究至关重要。本文探讨了两种小提琴 EMS 方法:一种是基于最新端到端文本到语音生成器的修改方案;另一种是基于简单的参数抽样过程,能够生成与 MIDI-DDSP 兼容的音符时长及其他参数。我们通过客观和主观实验研究了这两种方法(共计三种模型变体),并讨论了基于结果的若干关键问题。
引用
@article{arxiv.2406.18089,
title = {A Study on Synthesizing Expressive Violin Performances: Approaches and Comparisons},
author = {Tzu-Yun Hung and Jui-Te Wu and Yu-Chia Kuo and Yo-Wei Hsiao and Ting-Wei Lin and Li Su},
journal= {arXiv preprint arXiv:2406.18089},
year = {2024}
}
备注
15 pages, 2 figures, 3 tables