‘Studies for’:人类-AI 共同创作声音艺术品
声音
2025-11-03 v2 人工智能
摘要
本文通过与声音艺术家Evala合作创建Studies for——一个生成声音装置——探索了AI技术如何融入艺术工作流程。该装置采用SpecMaskGIT——一种轻量且高质量的声音生成AI模型——实时生成并播放八通道声音,为三个月的展览创造沉浸式听觉体验。该作品以“一种新的存档形式”为理念,旨在保存艺术家的艺术风格,同时通过持续生成新的声音元素超越艺术家过往作品。通过在200多小时的Evala过往声音艺术品数据集上训练AI模型来实现这一概念。本研究通过解决人类-AI共同创作艺术的关键需求,突显以下方面的价值:(1)整合艺术家反馈的必要性;(2)源自艺术家过往作品的数据集;(3)确保包含意外、新颖输出。Studies for中,该模型被设计为在生成全新、此前未听见的声音的同时,反映艺术家的艺术身份,成为“一种新的存档形式”的合适实现。我们提出了一种有效将声音生成AI模型融入声音艺术创作流程的人类-AI共同创作框架,并为超越艺术家物理存在的声音艺术创作与存档开辟了新可能性。演示页面:https://sony.github.io/studies-for/
关键词
引用
@article{arxiv.2510.25228,
title = {'Studies for': A Human-AI Co-Creative Sound Artwork Using a Real-time Multi-channel Sound Generation Model},
author = {Chihiro Nagashima and Akira Takahashi and Zhi Zhong and Shusuke Takahashi and Yuki Mitsufuji},
journal= {arXiv preprint arXiv:2510.25228},
year = {2025}
}
备注
Accepted at NeurIPS Creative AI Track 2025, 9 pages, 6 figures, 1 table, Demo page: https://sony.github.io/studies-for/