中文

Tadabur:大型阿克兰音频数据集

声音 2026-04-22 v1 人工智能

摘要

尽管对阿克兰数据研究兴趣日益增长,但现有阿克兰数据集在规模和多样性方面仍有限。为填补这一差距,我们提出Tadabur,一个大型阿克兰音频数据集。Tadabur 包含超过1400小时来自600多位不同 reciter 的朗读音频,提供了在朗读风格、声学特征和录音条件方面的大量变异。这种多样性使Tadabur成为阿克兰语音研究和分析的全面且具代表性的资源。通过显著扩大可用阿克兰数据的总时长和变异性,Tadabur旨在支持未来的研究并促进标准化阿克兰语音基准的开发。

关键词

引用

@article{arxiv.2604.18932,
  title  = {Tadabur: A Large-Scale Quran Audio Dataset},
  author = {Faisal Alherran},
  journal= {arXiv preprint arXiv:2604.18932},
  year   = {2026}
}

备注

Project page: https://fherran.github.io/tadabur/