2020 零资源语音挑战赛:发现离散子词与词单元
计算与语言
2020-10-14 v1 人工智能
摘要
我们提出 2020 零资源语音挑战赛,旨在无需任何标签地从原始音频信号中学习语音表示。它结合了先前两个基准(2017 和 2019)的数据集与度量,并包含两项触及两个层次语音表示的任务。第一项任务是发现低比特率子词表示以优化语音合成质量;第二项是从未分段的原始语音中发现类词单元。我们展示了二十个提交模型的结果,并讨论了主要发现对无监督语音学习的启示。
引用
@article{arxiv.2010.05967,
title = {The Zero Resource Speech Challenge 2020: Discovering discrete subword and word units},
author = {Ewan Dunbar and Julien Karadayi and Mathieu Bernard and Xuan-Nga Cao and Robin Algayres and Lucas Ondel and Laurent Besacier and Sakriani Sakti and Emmanuel Dupoux},
journal= {arXiv preprint arXiv:2010.05967},
year = {2020}
}