中文

用于自动高声部和声生成的基于智能体的框架

声音 2025-10-02 v2 人工智能

摘要

在算法作曲领域,生成音乐上连贯且美学上令人愉悦的和声仍然是一个重大挑战。本文介绍了一种创新的基于智能体的 AI 高声和部音乐生成器,一个旨在以协作和模块化方式创建和声的多智能体系统。我们的框架包含四个专门化的智能体:用于解析和标准化输入乐谱的音乐摄取智能体;由 Chord-Former(Transformer 模型)驱动的和弦知识智能体,用于解读和提供复杂和弦符号的组成音;利用 Harmony-GPT 和 Rhythm-Net(RNN)来创作旋律和节奏上互补的和声线的和声生成智能体;以及采用基于 GAN 的符号到音频合成器将最终符号输出渲染为高保真音频的音频制作智能体。通过将特定任务委托给专门化的智能体,我们的系统有效地模拟了人类音乐家的协作过程。这种模块化的基于智能体的方法允许稳健的数据处理、深入的理论理解、创造性作曲和逼真的音频合成,最终形成一个能够为给定旋律生成复杂且语境恰当的高声部和声的系统。

关键词

引用

@article{arxiv.2509.24463,
  title  = {An Agent-Based Framework for Automated Higher-Voice Harmony Generation},
  author = {Nia D'Souza Ganapathy and Arul Selvamani Shaja},
  journal= {arXiv preprint arXiv:2509.24463},
  year   = {2025}
}