中文

面向马来语、印地语、泰米尔语和汉语音乐的数据集与分类模型

声音 2020-09-16 v2 机器学习 音频与语音处理

摘要

在本文中,我们提出了一个新数据集,包含新加坡三大族群——华人、马来人和印度人(含印地语和泰米尔语)的音乐片段。我们利用该新数据集训练不同的分类模型,以区分这些族群来源的音乐。通过探索使用不同的音乐特征作为输入,对分类模型进行了优化。从音频文件中提取了高层特征(即具有音乐意义的特征)和低层特征(即基于频谱图的特征),以优化不同分类模型的性能。

关键词

引用

@article{arxiv.2009.04459,
  title  = {A dataset and classification model for Malay, Hindi, Tamil and Chinese music},
  author = {Fajilatun Nahar and Kat Agres and Balamurali BT and Dorien Herremans},
  journal= {arXiv preprint arXiv:2009.04459},
  year   = {2020}
}

备注

4 pages