基于谐波加噪声模型与歌唱表情分析的普通话歌唱语音合成
声音
2015-02-17 v1
摘要
本研究旨在探究人类如何富有表现力地诠释乐谱,进而设计如人类般歌唱的机器。我们考虑了六个对人声歌唱表现力有强烈影响的因素。这些因素与真实歌唱信号的声学、语音和音乐特征相关。给定遵循MIDI乐谱和歌词录制的真实歌唱声音,我们的分析模块可半自动地从真实歌唱信号中提取表现参数。这些表现参数用于控制基于谐波加噪声模型(HNM)的普通话歌唱语音合成(SVS)系统。感知实验结果表明,将表现因素集成到SVS系统中可显著改善感知自然度、清晰度和表现力。通过真实歌唱信号与表现控制到合成器的一对一映射,我们的SVS系统能以说话人的音色模拟真实歌手的诠释。
引用
@article{arxiv.1502.04300,
title = {Mandarin Singing Voice Synthesis Based on Harmonic Plus Noise Model and Singing Expression Analysis},
author = {Ju-Chiang Wang and Hung-Yan Gu and Hsin-Min Wang},
journal= {arXiv preprint arXiv:1502.04300},
year = {2015}
}
备注
8 pages, technical report