中文

利用用户提供的结构上下文进行旋律填空

声音 2022-10-07 v1 机器学习 音频与语音处理

摘要

本文提出一种基于 Transformer 的乐谱填空新模型,用于生成填充于给定前文与后文上下文之间间隙的音乐段落。尽管现有填空方法能生成与给定上下文在局部平滑衔接的段落,但它们未考虑音乐的形式或结构,因此可能生成过于平滑的结果。为解决此问题,我们提出一种结构感知的条件化方法,采用一种新颖的注意力选择模块将用户提供的结构相关信息提供给 Transformer 以进行填空。通过客观与主观评价,我们表明所提模型能有效利用结构信息,并生成比两个现有结构无关填空模型质量更高的流行风格旋律。

关键词

引用

@article{arxiv.2210.02829,
  title  = {Melody Infilling with User-Provided Structural Context},
  author = {Chih-Pin Tan and Alvin W. Y. Su and Yi-Hsuan Yang},
  journal= {arXiv preprint arXiv:2210.02829},
  year   = {2022}
}