Sudowoodo:基于源歌词的中文歌词仿写系统
计算与语言
2023-10-10 v1
摘要
歌词生成是自然语言生成研究中一项广为人知的应用,此前若干研究聚焦于利用关键词、韵律等精确控制来生成准确的歌词。然而,歌词仿写——即通过模仿源歌词的风格与内容来创作新歌词——由于缺乏平行语料库而仍是一项具有挑战性的任务。本文介绍\textbf{\textit{Sudowoodo}},一个能够基于源歌词文本生成新歌词的中文歌词仿写系统。为解决歌词仿写缺乏平行训练语料的问题,我们提出一种新颖的框架,基于源歌词的关键词歌词模型来构建平行语料库。随后,这些\textit{(新歌词,源歌词)}配对被用于训练歌词仿写模型。在推理过程中,我们利用后处理模块对生成的歌词进行过滤与排序,挑选出质量最高的歌词。作为附加内容,我们融入了音频信息并将歌词与音频对齐以形成歌曲。人工评估结果表明,我们的框架能够实现更好的歌词仿写。同时,\textit{Sudowoodo}系统及系统演示视频可在\href{https://Sudowoodo.apps-hp.danlu.netease.com/}{Sudowoodo}与\href{https://youtu.be/u5BBT_j1L5M}{https://youtu.be/u5BBT\_j1L5M}获取。
引用
@article{arxiv.2308.04665,
title = {Sudowoodo: a Chinese Lyric Imitation System with Source Lyrics},
author = {Yongzhu Chang and Rongsheng Zhang and Lin Jiang and Qihang Chen and Le Zhang and Jiashu Pu},
journal= {arXiv preprint arXiv:2308.04665},
year = {2023}
}
备注
7 pages,3 figures, submit to emnlp 2023 demo track