通过同音扩展与统一用字改进低资源粤语语音识别中的生僻词识别
计算与语言
2023-02-03 v1 声音
音频与语音处理
摘要
同音字在基于声调音节的语言(如普通话和粤语)中十分常见。数据密集的端到端自动语音识别(ASR)系统在低资源设定下更易误识同音字与生僻词。针对低资源粤语语音识别问题,本文提出一种新颖的同音扩展方法,将同音词典的人类知识整合进带语言模型重打分的束搜索解码过程。此外,我们提出一种自动统一用字方法,以合并粤语字符的变体并规范语音标注准则,从而通过为合并后字符提供更多样本来更高效利用已标注语句。我们通过实验表明,同音扩展与统一用字在域内与域外测试集上均显著提升识别性能,字符错误率(CER)绝对下降约 5% 与 18%。
引用
@article{arxiv.2302.00836,
title = {Improving Rare Words Recognition through Homophone Extension and Unified Writing for Low-resource Cantonese Speech Recognition},
author = {HoLam Chung and Junan Li and Pengfei Liu1 and Wai-Kim Leung and Xixin Wu and Helen Meng},
journal= {arXiv preprint arXiv:2302.00836},
year = {2023}
}
备注
The 13th International Symposium on Chinese Spoken Language Processing (ISCSLP 2022)