中文

WildElder:来自真实场景的细粒度人工标注中文老年语音数据集

声音 2025-10-13 v1 音频与语音处理

摘要

老年语音由于与年龄相关的变化(如发音迟缓嗓音震颤)而对自动处理提出独特挑战。现有的中文数据集大多在受控环境中录制,限制了其多样性和现实应用性。为填补这一空白,我们提出了WildElder——一个从在线视频收集的普通话老年语音语料库,并 enriched with 细粒度人工标注,包括转录、说话人年龄、性别和口音强度。结合真实场景数据的现实性与专家策划,WildElder为自动语音识别和说话人画像研究提供了有力支撑。实验结果揭示了老年语音识别的困难以及WildElder作为具有挑战性的新基准的潜力。数据集和代码可在https://github.com/NKU-HLT/WildElder获取。

关键词

引用

@article{arxiv.2510.09344,
  title  = {WildElder: A Chinese Elderly Speech Dataset from the Wild with Fine-Grained Manual Annotations},
  author = {Hui Wang and Jiaming Zhou and Jiabei He and Haoqin Sun and Yong Qin},
  journal= {arXiv preprint arXiv:2510.09344},
  year   = {2025}
}