HSD:一个分层歌唱标注数据集
声音
2022-10-03 v1
摘要
通常音乐具有明显 hierarchical 结构,尤其是作为流行歌曲主旋律的歌唱部分。然而,当前大多数歌唱标注数据集仅记录音符的符号信息,忽略了音乐的结构。本文提出一个分层歌唱标注数据集,包含来自 Youtube 的 68 首流行歌曲。该数据集以增强的 LyRiCs 格式记录每个音符的起止时间、音高、时长和歌词,以呈现音乐的分层结构。我们分两阶段标注每首歌曲:首先,利用对应的乐谱和歌词文件创建初始标签;其次,参考原始音频手动校准这些标签。我们主要通过将其与自动歌唱转写(AST)数据集比较来验证所提数据集的标注准确性。结果表明所提数据集达到了 AST 数据集的标注准确性。
引用
@article{arxiv.2209.15640,
title = {HSD: A hierarchical singing annotation dataset},
author = {Xiao Fu and Xin Yuan and Jinglu Hu},
journal= {arXiv preprint arXiv:2209.15640},
year = {2022}
}