中文

音乐语料上的朴素词典:从知识表示到模式识别

信息检索 2018-12-03 v1 机器学习 声音 音频与语音处理 机器学习

摘要

本文提出并发展了将乐谱在传统文本分析意义上视为文学文档的新颖想法,以充分受益于统计文本挖掘与主题建模中已有的大量研究。我们具体引入将任意给定音乐作品表示为一组“音乐词”集合的想法,我们将其代称为“muselets”,其本质上是不同长度的音乐词。鉴于构建完整 muselets 词典的新颖性因而极难恰当形成,本文聚焦于终极词典的一个更简但朴素的版本,我们称之为朴素词典,因为所有词长度相同。我们具体在此构建了一个由非裔美国人、中国、日本与阿拉伯音乐构成的语料上的朴素词典,并对其进行主题建模与模式识别。尽管基于朴素词典的部分结果相当良好,我们预期一旦着手实际构建我们预期 muselets 词典的完全规模完整版本,将获得非凡的预测性能。

关键词

引用

@article{arxiv.1811.12802,
  title  = {Naive Dictionary On Musical Corpora: From Knowledge Representation To Pattern Recognition},
  author = {Qiuyi Wu and Ernest Fokoue},
  journal= {arXiv preprint arXiv:1811.12802},
  year   = {2018}
}

备注

25 pages