中文

用于改进参数语音合成的本征残差方法

声音 2020-01-06 v1 计算与语言 音频与语音处理

摘要

统计参数语音合成器近来已展现出生成自然听感且灵活声音的能力。遗憾的是,由于语音经声码器处理,其输出质量受到一种典型蜂鸣声的影响。本文提出一种新的激励模型以减轻这一不良效应。该模型基于对基音同步残差帧在由主成分分析所得正交基上的分解。该基包含有限数量的本征残差,并在相对较小的语音数据库上计算。一条基于 PCA 的系数流被添加至我们基于 HMM 的合成器中,并可在合成时生成浊音激励。相较传统激励有改进报告,且合成引擎占用空间保持在约 1Mb 以下。

关键词

引用

@article{arxiv.2001.00581,
  title  = {Eigenresiduals for improved Parametric Speech Synthesis},
  author = {Thomas Drugman and Geoffrey Wilfart and Thierry Dutoit},
  journal= {arXiv preprint arXiv:2001.00581},
  year   = {2020}
}