中文

面向视听障碍人士的摩尔斯电码语音识别技术

声音 2024-07-23 v1 人工智能 计算与语言 人机交互 机器学习

摘要

该模型旨在为听力、言语或认知障碍人士开发一种语音识别技术。目前语音识别领域的所有可用技术都没有为听力、言语或认知障碍人士提供通信接口。该模型提出,用户的语音被传输到语音识别层,在那里被转换为文本,然后该文本被传输到莫尔斯电码转换层,在那里输出相应语音的莫尔斯电码。模型的准确性完全取决于语音识别,因为莫尔斯电码转换是一个过程。该模型使用不同参数的录制音频文件进行了测试。所提模型的词错误率(WER)和准确率分别确定为10.18%和89.82%。

关键词

引用

@article{arxiv.2407.14525,
  title  = {Morse Code-Enabled Speech Recognition for Individuals with Visual and Hearing Impairments},
  author = {Ritabrata Roy Choudhury},
  journal= {arXiv preprint arXiv:2407.14525},
  year   = {2024}
}

备注

10 pages, 11 figures, 4 tables