GANterpretations
声音
2020-11-11 v1 人工智能
机器学习
音频与语音处理
摘要
自生成对抗网络(GANs)[Goodfellow et al., 2014]提出以来,这类生成模型在技术进展(如Arjovsky et al. [2017])与创意应用(如[Karras et al., 2019, Zhu et al., 2017, Jin et al., 2017])方面持续涌现。本工作提出一种方法,利用GANs的能力,通过对齐录音的频谱特性,自动生成与音频录音相伴的视频。这使音乐人能够探索多模态创意表达的新形式:音乐演奏可诱导出由该演奏引导的AI生成音乐视频,同时也成为一种为叙事线索创建视觉叙事的媒介(类似于Frosst and Kereliuk [2019]所提出)。
引用
@article{arxiv.2011.05158,
title = {GANterpretations},
author = {Pablo Samuel Castro},
journal= {arXiv preprint arXiv:2011.05158},
year = {2020}
}
备注
In 4th Workshop on Machine Learning for Creativity and Design at NeurIPS 2020, Vancouver, Canada