中文

基于英语、韩语和泰语构音障碍语音数据集的可懂度分类多语言分析

计算与语言 2022-11-04 v2

摘要

本文分析来自三种具有不同韵律系统的语言——英语、韩语和泰语——的构音障碍语音数据集。我们考察了反映嗓音质量、发音与韵律三个语音维度的 39 项声学测量。作为多语言分析,按可懂度等级对声学测量的均值进行了检验。进一步,进行自动可懂度分类以细察各语言的最优特征集。分析表明,发音特征(如正确辅音率、正确元音率与正确音素率)为语言无关的测量。而嗓音质量与韵律特征通常呈现语言间的不同面向。实验结果另显示不同语音维度对不同语言作用更大:英语为韵律,韩语为发音,泰语则为韵律与发音二者。本文区分了英语、韩语和泰语构音障碍语音可懂度分类中语言无关与语言相关的测量,对言语病理学有所贡献。

关键词

引用

@article{arxiv.2209.13260,
  title  = {Multilingual analysis of intelligibility classification using English, Korean, and Tamil dysarthric speech datasets},
  author = {Eun Jung Yeo and Sunhee Kim and Minhwa Chung},
  journal= {arXiv preprint arXiv:2209.13260},
  year   = {2022}
}

备注

6 pages, 1 figure, O-COCOSDA 2022