中文

从语音中学习尼日利亚口音嵌入:基于 SautiDB-Naija 语料的初步结果

计算与语言 2021-12-14 v1 声音 音频与语音处理

摘要

本文描述了基于 SautiDB-Naija 的基础性工作,该语料是一个非母语(L2)尼日利亚英语语音的新语料库。我们描述了该语料如何被创建与整理,以及关于口音分类和学习尼日利亚口音嵌入的初步实验。该语料的初始版本包含来自尼日利亚语言(如约鲁巴语、伊博语、埃多语、埃菲克-伊比比奥语和伊加拉语)的 L2 英语使用者的 900 余条录音。我们进一步展示了如何在 wav2vec 等预训练模型上进行微调,以产生适用于口音分类等相关语音任务的表示。SautiDB-Naija 已发布至 Zenodo,在灵活的 Creative Commons 许可下供一般使用。

关键词

引用

@article{arxiv.2112.06199,
  title  = {Learning Nigerian accent embeddings from speech: preliminary results based on SautiDB-Naija corpus},
  author = {Tejumade Afonja and Oladimeji Mudele and Iroro Orife and Kenechi Dukor and Lawrence Francis and Duru Goodness and Oluwafemi Azeez and Ademola Malomo and Clinton Mbataku},
  journal= {arXiv preprint arXiv:2112.06199},
  year   = {2021}
}