面向音乐与音频的生成式人工智能
声音
2024-11-25 v1 人工智能
机器学习
多媒体
音频与语音处理
摘要
生成式人工智能正在改变我们与技术互动以及消费内容的方式。在未来十年里,AI技术将重塑我们在音乐、戏剧、电影、游戏、播客和短视频等各种媒介中创建音频内容的方式。本论文介绍了我围绕面向音乐与音频的生成式人工智能展开的三个主要研究方向:1)多轨音乐生成、2)辅助性音乐创作工具、3)音频与音乐的多模态学习。通过我的研究,我旨在回答以下两个根本性问题:1)AI如何能够帮助专业人士或业余爱好者创建音乐和音频内容?2)AI是否能够以类似人类学习音乐的方式来创作音乐?我的长期目标是降低音乐创作的门槛,使音频内容的创作更加民主化。
引用
@article{arxiv.2411.14627,
title = {Generative AI for Music and Audio},
author = {Hao-Wen Dong},
journal= {arXiv preprint arXiv:2411.14627},
year = {2024}
}
备注
PhD Dissertation