中文

PROCESS-2:用于早期认知障碍检测的基准语音语料库

声音 2026-05-15 v1 机器学习

摘要

基于语音的分析为检测认知衰退提供了一种可扩展且非侵入性的方法,但由于在现实条件下收集的临床验证数据集有限,其进展受到了限制。我们引入了 PROCESS-2,这是一个大规模语音数据集,旨在支持从自发语音和任务导向语音中自动评估认知障碍的研究。该数据集包含来自 200 名健康对照组、150 名轻度认知障碍和 50 名痴呆症诊断的录音,这些录音是使用 CognoMemory 数字评估平台收集的。每位参与者完成了一次评估,包括图片描述和言语流畅性任务,并附有手动验证的转录文本和参与者级别的元数据。PROCESS-2 包含大约 21 小时的语音音频,并具有预定义的训练/测试划分。全面的技术验证评估了人口统计学平衡、临床一致性、录音稳定性、嵌入空间结构以及可复现的基线建模性能,证明了在保留真实世界对话变异性的同时,具有临床意义的组间分离和跨建模方法的稳定性能。PROCESS-2 通过 Hugging Face 在受控访问下发布,以实现负责任的重复使用,同时保护参与者隐私,为基于语音的认知评估研究提供可复现的基准资源。

关键词

引用

@article{arxiv.2605.14888,
  title  = {PROCESS-2: A Benchmark Speech Corpus for Early Cognitive Impairment Detection},
  author = {Madhurananda Pahar and Caitlin H. Illingworth and Bahman Mirheidari and Hend Elghazaly and Fritz Peters and Sophie Young and Wing-Zin Leung and Labhpreet Kaur and Daniel Blackburn and Heidi Christensen},
  journal= {arXiv preprint arXiv:2605.14888},
  year   = {2026}
}