用于改进参数语音合成的本征残差方法
声音
2020-01-06 v1 计算与语言
音频与语音处理
摘要
统计参数语音合成器近来已展现出生成自然听感且灵活声音的能力。遗憾的是,由于语音经声码器处理,其输出质量受到一种典型蜂鸣声的影响。本文提出一种新的激励模型以减轻这一不良效应。该模型基于对基音同步残差帧在由主成分分析所得正交基上的分解。该基包含有限数量的本征残差,并在相对较小的语音数据库上计算。一条基于 PCA 的系数流被添加至我们基于 HMM 的合成器中,并可在合成时生成浊音激励。相较传统激励有改进报告,且合成引擎占用空间保持在约 1Mb 以下。
引用
@article{arxiv.2001.00581,
title = {Eigenresiduals for improved Parametric Speech Synthesis},
author = {Thomas Drugman and Geoffrey Wilfart and Thierry Dutoit},
journal= {arXiv preprint arXiv:2001.00581},
year = {2020}
}