中文

基于多智能体系统的中文歌词生成

计算与语言 2024-10-03 v1 人工智能

摘要

生成式大型语言模型展现出惊人的原样学习能力,仅凭提示词即可在各种任务中表现良好。先前的旋律到歌词研究受限于稀缺的高质量对齐数据和创造性标准不清晰的限制。大多数努力集中于一般主题或情感,这在当前语言模型能力下价值较低。对于像中文这样的音调语言,音准轮廓受到旋律和音调的双重影响,导致歌词与旋律的配合存在变化。我们的研究通过 Mpop600 数据集验证,歌词作者和旋律作者在创作过程中会考虑这种配合。在本研究中,我们开发了一个多智能体系统,将旋律到歌词任务分解为子任务,每个智能体控制韵律、音节数、歌词与旋律的配合以及一致性。通过扩散式唱腔合成器进行听觉测试,以评估不同智能体组合生成歌词的质量。

关键词

引用

@article{arxiv.2410.01450,
  title  = {Agent-Driven Large Language Models for Mandarin Lyric Generation},
  author = {Hong-Hsiang Liu and Yi-Wen Liu},
  journal= {arXiv preprint arXiv:2410.01450},
  year   = {2024}
}

备注

6 pages, figures, Accepted at O-COCOSDA 2024