情感端到端神经语音合成器
声音
2018-11-07 v2 计算与语言
音频与语音处理
摘要
本文介绍一种基于近期端到端神经模型 Tacotron 的情感语音合成器。尽管有其优势,我们发现原始 Tacotron 存在曝光偏差问题及注意力对齐的不规则性。随后,我们通过在循环神经网络(RNN)中利用上下文向量与残差连接解决了该问题。实验表明,该模型能成功训练并针对给定情感标签生成语音。
引用
@article{arxiv.1711.05447,
title = {Emotional End-to-End Neural Speech Synthesizer},
author = {Younggun Lee and Azam Rabiee and Soo-Young Lee},
journal= {arXiv preprint arXiv:1711.05447},
year = {2018}
}
备注
5 pages, 3 figures