大语言模型:从笔记到音乐形式
声音
2024-04-19 v1 音频与语音处理
摘要
虽然许多关于自动化音乐生成的学习方法正在积极研究,但在音乐形式方面仍有不足。特别是,最近基于深度学习模型的方法在生成的音乐中,最大尺度上缺乏任何结构。实际中,超过一分钟的此类模型生成的音乐要么令人不愉快地重复,要么没有方向。适应最近的音乐生成模型,本文提出了一种新的方法来生成具有形式的音乐。实验结果表明,所提出的方法能够生成持续2.5分钟的音乐,被认为与用于训练模型的音乐相当。本文首先回顾了基于语言模型(Transformer 架构)的音乐生成方法。我们讨论了为什么通过此类模型学习音乐形式是不可行的。然后我们讨论我们提出的方法和实验。
关键词
引用
@article{arxiv.2404.11976,
title = {Large Language Models: From Notes to Musical Form},
author = {Lilac Atassi},
journal= {arXiv preprint arXiv:2404.11976},
year = {2024}
}