2019 零资源语音挑战赛:无文本的语音合成
计算与语言
2019-07-09 v2 声音
音频与语音处理
摘要
我们提出了 2019 零资源语音挑战赛(Zero Resource Speech Challenge 2019),其目标是构建无任何文本或音素标签的语音合成器:即无 T 的 TTS(无文本的 text-to-speech)。我们提供一种未知语言目标说话人的原始音频(Voice 数据集),但不提供对齐、文本或标签。参与者必须以无监督方式发现子词单元(使用 Unit Discovery 数据集),并将其以最适于从新说话人合成类似目标说话人语音的新语句的方式对齐到语音录音中。我们描述了用于评估的指标、一个由无监督子词单元发现加标准 TTS 系统组成的基线系统,以及一个使用黄金音素转写的 topline TTS。我们概述了来自 10 个团队的 19 个提交系统,并讨论了主要结果。
引用
@article{arxiv.1904.11469,
title = {The Zero Resource Speech Challenge 2019: TTS without T},
author = {Ewan Dunbar and Robin Algayres and Julien Karadayi and Mathieu Bernard and Juan Benjumea and Xuan-Nga Cao and Lucie Miskic and Charlotte Dugrain and Lucas Ondel and Alan W. Black and Laurent Besacier and Sakriani Sakti and Emmanuel Dupoux},
journal= {arXiv preprint arXiv:1904.11469},
year = {2019}
}
备注
Interspeech 2019