Tadabur:大型阿克兰音频数据集
声音
2026-04-22 v1 人工智能
摘要
尽管对阿克兰数据研究兴趣日益增长,但现有阿克兰数据集在规模和多样性方面仍有限。为填补这一差距,我们提出Tadabur,一个大型阿克兰音频数据集。Tadabur 包含超过1400小时来自600多位不同 reciter 的朗读音频,提供了在朗读风格、声学特征和录音条件方面的大量变异。这种多样性使Tadabur成为阿克兰语音研究和分析的全面且具代表性的资源。通过显著扩大可用阿克兰数据的总时长和变异性,Tadabur旨在支持未来的研究并促进标准化阿克兰语音基准的开发。
引用
@article{arxiv.2604.18932,
title = {Tadabur: A Large-Scale Quran Audio Dataset},
author = {Faisal Alherran},
journal= {arXiv preprint arXiv:2604.18932},
year = {2026}
}
备注
Project page: https://fherran.github.io/tadabur/