Vakyansh:面向低资源印度语言的 ASR 工具包
计算与语言
2022-06-16 v2 音频与语音处理
摘要
我们提出 Vakyansh,一个用于印度语言语音识别的端到端工具包。印度拥有近 121 种语言和约 125 千万说话者。然而,大多数语言在数据量和预训练模型方面属于低资源。通过 Vakyansh,我们引入了用于数据创建、模型训练、模型评估和部署的自动化数据流水线。我们创建了 23 种印度语言的 14,000 小时语音数据,并训练了基于 wav2vec 2.0 的预训练模型。这些预训练模型随后被微调以创建 18 种印度语言的先进语音识别模型,并辅以语言模型和标点恢复模型。我们开源所有这些资源,旨在激励语音社区使用我们的印度语言 ASR 模型开发语音优先的应用。
引用
@article{arxiv.2203.16512,
title = {Vakyansh: ASR Toolkit for Low Resource Indic languages},
author = {Harveen Singh Chadha and Anirudh Gupta and Priyanshi Shah and Neeraj Chhimwal and Ankur Dhuriya and Rishabh Gaur and Vivek Raghavan},
journal= {arXiv preprint arXiv:2203.16512},
year = {2022}
}