中文

GANterpretations

声音 2020-11-11 v1 人工智能 机器学习 音频与语音处理

摘要

自生成对抗网络(GANs)[Goodfellow et al., 2014]提出以来,这类生成模型在技术进展(如Arjovsky et al. [2017])与创意应用(如[Karras et al., 2019, Zhu et al., 2017, Jin et al., 2017])方面持续涌现。本工作提出一种方法,利用GANs的能力,通过对齐录音的频谱特性,自动生成与音频录音相伴的视频。这使音乐人能够探索多模态创意表达的新形式:音乐演奏可诱导出由该演奏引导的AI生成音乐视频,同时也成为一种为叙事线索创建视觉叙事的媒介(类似于Frosst and Kereliuk [2019]所提出)。

关键词

引用

@article{arxiv.2011.05158,
  title  = {GANterpretations},
  author = {Pablo Samuel Castro},
  journal= {arXiv preprint arXiv:2011.05158},
  year   = {2020}
}

备注

In 4th Workshop on Machine Learning for Creativity and Design at NeurIPS 2020, Vancouver, Canada