PronouncUR:一个乌尔都语发音词典生成器
计算与语言
2018-03-06 v2
摘要
最先进的语音识别系统严重依赖三个基本组件:声学模型、发音词典和语言模型。构建这些组件需要研究者具备语言学与技术专长,这在低资源领域是一道壁垒。无需专家领域知识即可构建这三个组件的技术需求巨大。乌尔都语尽管全球有数百万使用者,但就标准公开可用的语言资源而言是一种低资源语言。本文中,我们提出一个乌尔都语字素到音素转换工具,可从乌尔都语词表生成适用于语音识别系统的发音词典。该工具使用基于 LSTM 的模型预测词的发音,模型在约 39,000 词的人工专家词典上训练,内部评估准确率达 64%。在语音识别任务的外部评估中,我们所获词错误率与完全使用人工专家词典所得相当。
引用
@article{arxiv.1801.00409,
title = {PronouncUR: An Urdu Pronunciation Lexicon Generator},
author = {Haris Bin Zia and Agha Ali Raza and Awais Athar},
journal= {arXiv preprint arXiv:1801.00409},
year = {2018}
}
备注
5 pages, LREC 2018