中文

BembaSpeech:一种用于本巴语的语音识别语料库

计算与语言 2021-02-10 v1

摘要

我们呈现一个经过预处理、即取即用的自动语音识别语料库 BembaSpeech,其包含超过 24 小时本巴语朗读语音;本巴语是一种书面但低资源的语言,由赞比亚超过 30% 的人口使用。为评估其对本巴语 ASR 系统训练与测试的效用,我们通过在本巴语 BembaSpeech 语料库的训练部分上微调预训练的 DeepSpeech 英语模型,训练了一个端到端本巴语 ASR 系统。我们的最佳模型取得了 54.78% 的词错误率(WER)。结果表明该语料库可用于构建本巴语 ASR 系统。语料库与模型已公开发布于 https://github.com/csikasote/BembaSpeech。

关键词

引用

@article{arxiv.2102.04889,
  title  = {BembaSpeech: A Speech Recognition Corpus for the Bemba Language},
  author = {Claytone Sikasote and Antonios Anastasopoulos},
  journal= {arXiv preprint arXiv:2102.04889},
  year   = {2021}
}