构音障碍语音识别的混合特征提取与声学建模方法
声音
2015-06-09 v1 计算与语言
摘要
构音障碍是由人体神经系统衰弱引起的运动性言语功能障碍。其特征是言语含糊以及身体损伤,限制了他们的交流,造成信心缺乏并影响生活方式。本文试图提高未受损语音信号的自动语音识别(ASR)系统效率。它描述了通过结合其语音产生知识来改进构音障碍说话者ASR的研究现状。提出了混合特征提取和声学建模技术以及进化算法以提高整体系统效率。这里改变了特征向量数量并测试了系统性能。观察到系统性能通过遗传算法得到提升。具有16个经遗传算法优化的声学特征的系统获得了98.28%的最高识别率,训练时间为5:30:17。
引用
@article{arxiv.1506.02170,
title = {Hybridized Feature Extraction and Acoustic Modelling Approach for Dysarthric Speech Recognition},
author = {Megha Rughani and D. Shivakrishna},
journal= {arXiv preprint arXiv:1506.02170},
year = {2015}
}