中文

运动性言语障碍中构音障碍、言语失用与典型发育言语的自动及感知判别

声音 2021-06-03 v3 音频与语音处理

摘要

在运动性言语障碍(MSDs)背景下的自动技术通常为二分类技术,旨在区分构音障碍与典型发育言语,或区分构音障碍与言语失用(AoS)。此外,尽管此类技术被提出用于辅助临床医生的感知评估,但自动与感知分类准确率从未被比较过。本文研究了一种三分类自动技术以及一组手工设计特征,用于区分构音障碍、AoS与典型发育言语。与常用的多分类一对一(One-versus-One)或一对多(One-versus-Rest)方法不同,本文提出了一种分层方法。此外,进行了一项感知研究,邀请言语和语言病理学家聆听构音障碍、AoS与典型发育言语的录音,并判断录音所属类别。所提出的自动技术在相同录音上进行评估,并比较了自动与感知分类性能。结果表明,分层分类方法的分类准确率高于基线一对一与一对多方法。进一步结果表明,自动方法的分类准确率高于言语和语言病理学家的感知评估,展示了在临床实践中集成自动工具的潜在优势。

关键词

引用

@article{arxiv.2011.07542,
  title  = {Automatic and perceptual discrimination between dysarthria, apraxia of speech, and neurotypical speech},
  author = {I. Kodrasi and M. Pernon and M. Laganaro and H. Bourlard},
  journal= {arXiv preprint arXiv:2011.07542},
  year   = {2021}
}

备注

ICASSP 2021