中文

Boli:用于理解阻塞经验和分析阻塞语音的数据集

人机交互 2025-05-02 v3 人工智能

摘要

存在对多样化、高质量阻塞语音数据的需求,尤其是在印度语言语境下。本文介绍了 Project Boli,一套多语言阻塞语音数据集,旨在推进针对阻塞者的科学理解和技术发展,尤其是在印度地区。该数据集包括(a)匿名化的元数据(性别、年龄、国家、母语)以及关于阻塞如何影响其日常生活的问卷回答,(b)为每个参与者捕获读作语音(使用彩虹段落)和自发语音(通过图像描述任务),(c)包括对五种阻塞类型(阻塞、拉长、插入声、声音重复和词语重复)的详细标注。我们呈现了对该数据集的全面分析,包括数据收集程序、阻塞者的经验总结、阻塞事件的严重程度评估以及所收集数据的技术验证。该数据集以开放方式发布,以进一步发展语音技术。

关键词

引用

@article{arxiv.2501.15877,
  title  = {Boli: A dataset for understanding stuttering experience and analyzing stuttered speech},
  author = {Ashita Batra and Mannas Narang and Neeraj Kumar Sharma and Pradip K Das},
  journal= {arXiv preprint arXiv:2501.15877},
  year   = {2025}
}