具备多级粒度音节数控制的歌曲结构感知全曲文本到歌词生成
计算与语言
2025-06-24 v3 人工智能
摘要
歌词生成面临独特的挑战,特别是在实现精确音节控制的同时遵循主歌和副歌等歌曲结构。传统的逐行生成方法常导致不自然的措辞,凸显了对更细粒度音节管理的需求。我们提出了一个歌词生成框架,能够在词、短语、行和段落级别实现多级音节控制,并具备歌曲结构感知能力。我们的方法以输入文本和歌曲结构为条件生成完整歌词,确保符合指定的音节约束。生成的歌词样本可在以下网址获取:https://tinyurl.com/lyrics9999
引用
@article{arxiv.2411.13100,
title = {Song Form-aware Full-Song Text-to-Lyrics Generation with Multi-Level Granularity Syllable Count Control},
author = {Yunkee Chae and Eunsik Shin and Suntae Hwang and Seungryeol Paik and Kyogu Lee},
journal= {arXiv preprint arXiv:2411.13100},
year = {2025}
}
备注
Accepted to Interspeech 2025