WildElder:来自真实场景的细粒度人工标注中文老年语音数据集
声音
2025-10-13 v1 音频与语音处理
摘要
老年语音由于与年龄相关的变化(如发音迟缓嗓音震颤)而对自动处理提出独特挑战。现有的中文数据集大多在受控环境中录制,限制了其多样性和现实应用性。为填补这一空白,我们提出了WildElder——一个从在线视频收集的普通话老年语音语料库,并 enriched with 细粒度人工标注,包括转录、说话人年龄、性别和口音强度。结合真实场景数据的现实性与专家策划,WildElder为自动语音识别和说话人画像研究提供了有力支撑。实验结果揭示了老年语音识别的困难以及WildElder作为具有挑战性的新基准的潜力。数据集和代码可在https://github.com/NKU-HLT/WildElder获取。
引用
@article{arxiv.2510.09344,
title = {WildElder: A Chinese Elderly Speech Dataset from the Wild with Fine-Grained Manual Annotations},
author = {Hui Wang and Jiaming Zhou and Jiabei He and Haoqin Sun and Yong Qin},
journal= {arXiv preprint arXiv:2510.09344},
year = {2025}
}