符号钢琴音乐的分段因子化全曲生成
声音
2025-10-08 v1 人工智能
机器学习
多媒体
音频与语音处理
摘要
我们提出了分段全曲模型(SFS)用于符号全曲生成。该模型接受用户提供的歌曲结构和可选的短种子片段,以便围绕该想法开发歌曲。通过将歌曲分解为片段并通过对相关片段的选择性注意来生成每个片段,模型实现了比以往工作更高的质量和效率。为演示其适合人机交互,我们进一步将SFS封装到一个Web应用程序中,该应用程序允许用户以可自定义结构和灵活排序方式在钢琴卷帘上迭代共同创作音乐。
引用
@article{arxiv.2510.05881,
title = {Segment-Factorized Full-Song Generation on Symbolic Piano Music},
author = {Ping-Yi Chen and Chih-Pin Tan and Yi-Hsuan Yang},
journal= {arXiv preprint arXiv:2510.05881},
year = {2025}
}
备注
Accepted to the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: AI for Music