基于自监督语音表征学习的土耳其语自动语音识别实验
计算与语言
2022-12-26 v3 机器学习
声音
音频与语音处理
摘要
尽管土耳其语被列为低资源语言,关于土耳其语自动语音识别(ASR)的文献相对陈旧。在本报告中,我们呈现使用HUBERT进行语音表征学习的土耳其语ASR发现。我们研究利用从在线资源整理的大规模数据对土耳其语HUBERT进行预训练。我们使用来自YouTube的6,500小时语音数据预训练模型。结果显示模型尚未准备好用于商业用途,因为它们对真实场景中典型出现的口音变化、俚语、背景噪声与干扰不够鲁棒。我们分析了典型错误及模型用于商业环境的局限性。
引用
@article{arxiv.2210.07323,
title = {Experiments on Turkish ASR with Self-Supervised Speech Representation Learning},
author = {Ali Safaya and Engin Erzin},
journal= {arXiv preprint arXiv:2210.07323},
year = {2022}
}