面向视听障碍人士的摩尔斯电码语音识别技术
声音
2024-07-23 v1 人工智能
计算与语言
人机交互
机器学习
摘要
该模型旨在为听力、言语或认知障碍人士开发一种语音识别技术。目前语音识别领域的所有可用技术都没有为听力、言语或认知障碍人士提供通信接口。该模型提出,用户的语音被传输到语音识别层,在那里被转换为文本,然后该文本被传输到莫尔斯电码转换层,在那里输出相应语音的莫尔斯电码。模型的准确性完全取决于语音识别,因为莫尔斯电码转换是一个过程。该模型使用不同参数的录制音频文件进行了测试。所提模型的词错误率(WER)和准确率分别确定为10.18%和89.82%。
引用
@article{arxiv.2407.14525,
title = {Morse Code-Enabled Speech Recognition for Individuals with Visual and Hearing Impairments},
author = {Ritabrata Roy Choudhury},
journal= {arXiv preprint arXiv:2407.14525},
year = {2024}
}
备注
10 pages, 11 figures, 4 tables