中文

面向自动无障碍语音识别:阿坎语的受损语音数据集

声音 2026-02-06 v1 人工智能

摘要

受损语音数据的缺乏阻碍了包容性语音技术在低资源语言(如阿坎语)方面的发展。为填补这一空白,本研究呈现了一个来自阿坎语母语者的受损语音样本精选语料库。该数据集包含 50.01 小时的音频录音,覆盖四类受损语音,包括顽语、脑瘤性瘫痪、裂咽和中风引起的语音障碍。录音在受控监督环境中进行,参与者用自己的话描述预先选定的图像。 resulting dataset 是一组音频录音、转录文本以及关于说话人人口学信息、障碍类型、录音环境和设备的相关元数据的集合。该数据集旨在支持低资源自动受损语音识别系统和辅助语音技术的研究。

关键词

引用

@article{arxiv.2602.05406,
  title  = {Enabling Automatic Disordered Speech Recognition: An Impaired Speech Dataset in the Akan Language},
  author = {Isaac Wiafe and Akon Obu Ekpezu and Sumaya Ahmed Salihs and Elikem Doe Atsakpo and Fiifi Baffoe Payin Winful and Jamal-Deen Abdulai},
  journal= {arXiv preprint arXiv:2602.05406},
  year   = {2026}
}