中文

若两个音乐版本不共享旋律、和声、节奏或歌词会怎样?

声音 2022-10-05 v1 机器学习 音频与语音处理

摘要

版本识别(VI)在过去几年中取得了显著进展。一方面,度量学习范式的引入促进了可扩展且准确的VI系统的出现。另一方面,使用聚焦于音乐作品特定方面(如旋律、和声或歌词)的特征,带来了可解释且令人鼓舞的性能。在本工作中,我们基于这些近期进展,提出了一种基于度量学习的系统,系统地利用四个被广泛认可用于传达版本间音乐相似性的维度:旋律线、和声结构、节奏模式与歌词。我们描述了我们有意设计的简单模型架构,并特别表明,歌词的近似表示是区分版本与非版本的有效代理。我们随后描述了这些特征如何相互补充,并在两个公开可用数据集上取得了新的最先进(SOTA)性能。我们最后提出,使用旋律、和声、节奏与歌词特征组合的VI系统,在理论上可达到这些数据集上可获得的最优性能。

关键词

引用

@article{arxiv.2210.01256,
  title  = {And what if two musical versions don't share melody, harmony, rhythm, or lyrics ?},
  author = {Mathilde Abrassart and Guillaume Doras},
  journal= {arXiv preprint arXiv:2210.01256},
  year   = {2022}
}