中文

用于重复语音样本收集与分析的方法学框架与范例协议

声音 2025-08-15 v3 音频与语音处理

摘要

语音和语言生物标志物有潜力成为多种健康状况下(无论是临床中还是远程使用移动设备)症状严重程度的常规、客观评估。然而,语音的复杂性以及与健康相关的微妙变化往往导致其发现高度依赖于方法学和队列选择。这些因素往往未在研究语音基医学评估时充分报道,阻碍了方法学语音研究的进展。我们的目标包括:1)通过呈现可适应的语音收集和分析方法及设计清单,促进可复制的语音研究;2)开发一个范例协议,以减少和控制重复语音录音中包含的混杂因素,包括设备选择、语音触发任务和非疾病性变异。所提出的协议包括使用自由悬臂浊度麦克风、3部智能手机和耳机收集朗读语音、held 元音和图片描述。我们提取了 14 个典型语音特征。我们从 28 名健康者那里收集了语音样本,3 天内重复测量 3 次,随后在 8-11 周后再次以相同时间重复测量;以及从另 25 名健康者那里收集语音样本,3 天内在固定时间重复测量。收集的参与者特征包括性别、年龄、母语状态和语音使用习惯。在每次录音前,我们收集了关于最近语音使用、食物和饮料摄入情况以及情绪状态的信息。所提取的特征提供了规范性价值的资源。语音数据收集、处理、分析和报告在临床研究和实践中的方式差异很大。迫切需要更一致地规范研究方法并保持一致的报告,以将语音处理转化为临床研究和实践。

关键词

引用

@article{arxiv.2406.07497,
  title  = {A methodological framework and exemplar protocol for the collection and analysis of repeated speech samples},
  author = {Nicholas Cummins and Lauren L. White and Zahia Rahman and Catriona Lucas and Tian Pan and Ewan Carr and Faith Matcham and Johnny Downs and Richard J. Dobson and Thomas F. Quatieri and Judith Dineley},
  journal= {arXiv preprint arXiv:2406.07497},
  year   = {2025}
}

备注

Main manuscript: 37 pages. 3 figures, 8 tables, 1 textbox. Submitted to JMIR Research Methods. Replacement with format changes and copyediting