中文

Vakyansh:面向低资源印度语言的 ASR 工具包

计算与语言 2022-06-16 v2 音频与语音处理

摘要

我们提出 Vakyansh,一个用于印度语言语音识别的端到端工具包。印度拥有近 121 种语言和约 125 千万说话者。然而,大多数语言在数据量和预训练模型方面属于低资源。通过 Vakyansh,我们引入了用于数据创建、模型训练、模型评估和部署的自动化数据流水线。我们创建了 23 种印度语言的 14,000 小时语音数据,并训练了基于 wav2vec 2.0 的预训练模型。这些预训练模型随后被微调以创建 18 种印度语言的先进语音识别模型,并辅以语言模型和标点恢复模型。我们开源所有这些资源,旨在激励语音社区使用我们的印度语言 ASR 模型开发语音优先的应用。

关键词

引用

@article{arxiv.2203.16512,
  title  = {Vakyansh: ASR Toolkit for Low Resource Indic languages},
  author = {Harveen Singh Chadha and Anirudh Gupta and Priyanshi Shah and Neeraj Chhimwal and Ankur Dhuriya and Rishabh Gaur and Vivek Raghavan},
  journal= {arXiv preprint arXiv:2203.16512},
  year   = {2022}
}