中文

SeniorTalk:一个带有丰富标注的超高龄老年人中文对话数据集

计算与语言 2025-11-13 v2 声音 音频与语音处理

摘要

虽然语音技术越来越多地服务于老龄化人口,但当前系统由于缺乏捕捉老年人特有声音特征(如老年性发声和方言变异)的训练数据,表现出显著的性能差距。现有老年人语音数据集中关于超高龄个体的数据有限,加上过于简单的录音风格和标注维度,加剧了这一问题。为了解决75岁及以上个体语音数据严重匮乏的问题,我们引入了SeniorTalk,一个经过精心标注的中文口语对话数据集。该数据集包含来自101个自然对话的55.53小时语音,涉及202名参与者,确保了性别、地区和年龄的战略平衡。通过跨多个维度的详细标注,它可以支持广泛的语音任务。我们对说话人验证、说话人日志、语音识别和语音编辑任务进行了广泛的实验,为针对该年龄段人群的语音技术开发提供了关键见解。

关键词

引用

@article{arxiv.2503.16578,
  title  = {SeniorTalk: A Chinese Conversation Dataset with Rich Annotations for Super-Aged Seniors},
  author = {Yang Chen and Hui Wang and Shiyao Wang and Junyang Chen and Jiabei He and Jiaming Zhou and Xi Yang and Yequan Wang and Yonghua Lin and Yong Qin},
  journal= {arXiv preprint arXiv:2503.16578},
  year   = {2025}
}