笑声合成:将序列到序列建模与迁移学习相结合
音频与语音处理
2020-08-24 v1 计算与语言
机器学习
声音
摘要
尽管对富有表现力的语音合成的兴趣日益增长,但非言语表情的合成仍是一个未被充分探索的领域。在本文中,我们提出了一种基于序列到序列TTS合成系统的音频笑声合成系统。我们通过训练深度学习模型从标注中学习生成语音和笑声,从而利用迁移学习。我们通过听测评估我们的模型,将其性能与基于HMM的笑声合成方法进行比较,并确认其达到了更高的感知自然度。我们的解决方案是朝着能够合成具有娱乐程度控制并集成笑声的TTS系统的第一步。
引用
@article{arxiv.2008.09483,
title = {Laughter Synthesis: Combining Seq2seq modeling with Transfer Learning},
author = {Noé Tits and Kevin El Haddad and Thierry Dutoit},
journal= {arXiv preprint arXiv:2008.09483},
year = {2020}
}