面向音乐谱面的表达性钢琴演奏合成集成方法
声音
2025-01-20 v1 音频与语音处理
摘要
本文提出一种集成系统,将符号化音乐谱分解转换为表达性钢琴演奏音频。通过将基于Transformer的Expressive Performance Rendering (EPR)模型与微调的神经MIDI合成器相结合,我们的方法直接从谱面输入生成表达性音频演出。据我们所知,这是首个为没有表达控制的谱面MIDI文件生成丰富表达性钢琴演奏的流水线方法。我们使用ATEPP数据集的子集进行实验,采用客观指标和主观听觉测试评估该系统。我们的系统不仅准确重构类人表达性,还捕捉到演出厅和录音棚等环境的声学氛围。此外,所提系统在确保输出音频质量的同时,能够实现音乐表达性。
引用
@article{arxiv.2501.10222,
title = {Towards An Integrated Approach for Expressive Piano Performance Synthesis from Music Scores},
author = {Jingjing Tang and Erica Cooper and Xin Wang and Junichi Yamagishi and George Fazekas},
journal= {arXiv preprint arXiv:2501.10222},
year = {2025}
}
备注
Accepted by ICASSP 2025