SMART:基于音频领域审美奖励调节符号音乐生成系统
声音
2025-04-24 v1
摘要
近期工作提出了训练机器学习模型以预测音乐音频的审美评分。我们探索了此类模型是否可用于强化学习微调符号音乐生成系统,以及这对系统输出有何影响。为测试此假设,我们使用群体相对策略优化来微调钢琴MIDI模型,将Meta Audiobox Aesthetics对音频渲染输出的评分作为奖励。我们发现,这种优化对生成输出的多个低层次特征都有影响,并在由14名参与者参与的初步听觉研究中提升了平均主观评分。我们还发现,过度优化会显著降低模型输出的多样性。
引用
@article{arxiv.2504.16839,
title = {SMART: Tuning a symbolic music generation system with an audio domain aesthetic reward},
author = {Nicolas Jonason and Luca Casini and Bob L. T. Sturm},
journal= {arXiv preprint arXiv:2504.16839},
year = {2025}
}