面向爱沙尼亚语的神经语音合成
计算与语言
2020-10-07 v1
摘要
本技术报告描述了塔尔图大学NLP研究组与爱沙尼亚语言研究所就改进爱沙尼亚语神经语音合成所开展合作的结果。报告(以爱沙尼亚语撰写)描述了项目成果,其摘要为:(1) 收集并开放发布来自6位说话人的语音合成数据,总计92.4小时(CC-BY-4.0)。数据见 https://konekorpus.tartunlp.ai 与 https://www.eki.ee/litsents/。(2) 神经语音合成的软件与模型以开源方式发布(MIT许可)。见 https://koodivaramu.eesti.ee/tartunlp/text-to-speech 。(3) 我们对新模型进行了评估,并将其与其他现有方案(来自EKI的基于HMM的HTS模型,http://www.eki.ee/heli/,以及Google的爱沙尼亚语语音合成,通过 https://translate.google.com 访问)比较。评估包含句子级与较长片段的语音可接受性MOS分数、详细的错误分析以及预处理模块的评估。
引用
@article{arxiv.2010.02636,
title = {Neural Speech Synthesis for Estonian},
author = {Liisa Rätsep and Liisi Piits and Hille Pajupuu and Indrek Hein and Mark Fišel},
journal= {arXiv preprint arXiv:2010.02636},
year = {2020}
}
备注
9 pages in Estonian