中文

大语言模型:从笔记到音乐形式

声音 2024-04-19 v1 音频与语音处理

摘要

虽然许多关于自动化音乐生成的学习方法正在积极研究,但在音乐形式方面仍有不足。特别是,最近基于深度学习模型的方法在生成的音乐中,最大尺度上缺乏任何结构。实际中,超过一分钟的此类模型生成的音乐要么令人不愉快地重复,要么没有方向。适应最近的音乐生成模型,本文提出了一种新的方法来生成具有形式的音乐。实验结果表明,所提出的方法能够生成持续2.5分钟的音乐,被认为与用于训练模型的音乐相当。本文首先回顾了基于语言模型(Transformer 架构)的音乐生成方法。我们讨论了为什么通过此类模型学习音乐形式是不可行的。然后我们讨论我们提出的方法和实验。

关键词

引用

@article{arxiv.2404.11976,
  title  = {Large Language Models: From Notes to Musical Form},
  author = {Lilac Atassi},
  journal= {arXiv preprint arXiv:2404.11976},
  year   = {2024}
}