符号音乐数据版本 1.0
声音
2016-06-09 v1 人工智能
摘要
在本文档中,我们介绍了一个为训练符号音乐数据的机器学习模型而设计的新数据集。我们提供了五个数据集,其中一个来自新收集的包含 20K 个 midi 文件的语料库。我们描述了预处理与清洗流程,其中包括基于先前开发的概率机器学习模型的评分来排除部分文件。我们还基于一种聚类方案定义了新数据集的训练、测试和验证划分,该聚类方案我们亦在文中加以描述。文中包含了一些简单的直方图。
引用
@article{arxiv.1606.02542,
title = {Symbolic Music Data Version 1.0},
author = {Christian Walder},
journal= {arXiv preprint arXiv:1606.02542},
year = {2016}
}
备注
arXiv admin note: substantial text overlap with arXiv:1606.01368