中文

孟加拉语生物医学数据的自动语音识别

音频与语音处理 2024-06-21 v1 计算与语言 声音

摘要

本文介绍了一个专门为孟加拉语生物医学数据设计的原型自动语音识别(ASR)系统的开发。孟加拉语ASR的最新进展令人鼓舞,但缺乏特定领域的数据限制了实用医疗保健ASR模型的创建。本项目通过开发一个针对孟加拉语医学术语(如症状、严重程度和疾病)的ASR系统来弥合这一差距,该系统涵盖了两种主要方言:孟加拉语和锡尔赫特语。我们在一个包含46小时的孟加拉语医学语料库上训练和评估了两个流行的ASR框架。我们的核心目标是为数字健康应用创建可部署的健康领域ASR系统,最终提高医疗保健领域非技术用户的可及性。

关键词

引用

@article{arxiv.2406.12931,
  title  = {Automatic Speech Recognition for Biomedical Data in Bengali Language},
  author = {Shariar Kabir and Nazmun Nahar and Shyamasree Saha and Mamunur Rashid},
  journal= {arXiv preprint arXiv:2406.12931},
  year   = {2024}
}