面向分层口语语言不流畅性建模
计算与语言
2024-01-23 v2 音频与语音处理
摘要
语音不流畅性建模是言语治疗和语言学习的瓶颈。然而,目前尚无有效的人工智能解决方案来系统地解决这一问题。我们明确了不流畅语音及不流畅语音建模的概念。随后,我们提出了分层无约束不流畅性建模(Hierarchical Unconstrained Disfluency Modeling, H-UDM)方法,这是无约束不流畅性建模(UDM)的分层扩展,旨在同时解决不流畅性转写和检测问题,从而消除对大量人工标注的需求。我们的实验结果清楚地证明了我们所引入方法在转写和检测任务中的有效性和可靠性。
引用
@article{arxiv.2401.10015,
title = {Towards Hierarchical Spoken Language Dysfluency Modeling},
author = {Jiachen Lian and Gopala Anumanchipalli},
journal= {arXiv preprint arXiv:2401.10015},
year = {2024}
}
备注
2024 EACL. Hierarchical extension of our previous workshop paper arXiv:2312.12810