利用异构语料库训练ASR系统
计算与语言
2017-06-02 v1
摘要
本文总结了在SCALE(应用语言探索夏令营)2015年“低资源语言语音到文本翻译”研讨会上,作为普什图语语音翻译系统一部分而构建的LVCSR系统的开发情况。普什图语被选为一种良好的“代理”低资源语言,它展现出多种现象,使得语音识别和语音到文本翻译系统的开发变得困难。即使数据量看似充足,但由于数据来源于多个渠道,初步实验表明,合并(串联)这些语料库几乎没有益处,必须研究出更精细的方法来利用所有数据。本文仅关注LVCSR部分,并介绍了一系列被发现有助于从多个不同语料库中获益的技术。
引用
@article{arxiv.1706.00321,
title = {Using of heterogeneous corpora for training of an ASR system},
author = {Jan Trmal and Gaurav Kumar and Vimal Manohar and Sanjeev Khudanpur and Matt Post and Paul McNamee},
journal= {arXiv preprint arXiv:1706.00321},
year = {2017}
}