用模块化变分自编码器建模旋律特征依赖关系
人工智能
2018-11-02 v1 机器学习
多媒体
声音
音频与语音处理
摘要
自动旋律生成一直是 AI 研究人员和音乐家的长期愿望。然而,学习生成悦耳的旋律已被证明极具挑战性。本文介绍了 1)变分自编码器(VAE)的一种新变体,其模型结构以模块化方式设计,以便结合领域知识对复调与动态音乐进行建模;以及 2)一种分层编码/解码策略,显式地对旋律特征之间的依赖关系进行建模。所提出的框架能够生成自然听感且各异的旋律,并且用于评估生成音乐片段的实验表明,该模型在人类评估中优于基线方法。
引用
@article{arxiv.1811.00162,
title = {Modeling Melodic Feature Dependency with Modularized Variational Auto-Encoder},
author = {Yu-An Wang and Yu-Kai Huang and Tzu-Chuan Lin and Shang-Yu Su and Yun-Nung Chen},
journal= {arXiv preprint arXiv:1811.00162},
year = {2018}
}
备注
The first three authors contributed equally