面向多模态创作的生成式 AI 目的性混音:构建设计师语音
计算机与社会
2024-03-29 v1
摘要
语音是作家身份话语建构的表达方式,在写作理论研究中已得到广泛关注。在多模态写作中,学生能够动员语言和非语言资源来表达真实或想象的身份。但当学生受限于现有在线资源时,其语音可能因其作者意图与现有材料之间的不兼容性而受到妥协。因此,本研究探讨生成式 AI 工具是否能帮助学生作家在多模态写作中构建更一致的语音。本研究设计了一个照片散文作业,让学生以照片散文形式叙述故事,并提示 AI 图像生成工具为其叙事创建图片。基于对七位核心参与者的访谈数据、书面反思、书面注释和多模态作品,我们识别出两种混音实践,学生通过这些实践试图在写作中建立连贯且独特的语音。该研究揭示了 AI 作为技术灵活性所提供的多模态写作的有意图性和话语性特征,同时也突显了由于学生提示不足和多模态素养不足以及 AI 系统固有的局限性,可能引发的实际和伦理挑战。该研究为将 AI 工具纳入设计多模态写作任务方面提供了重要启示。
引用
@article{arxiv.2403.19095,
title = {Purposeful remixing with generative AI: Constructing designer voice in multimodal composing},
author = {Xiao Tan and Wei Xu and Chaoran Wang},
journal= {arXiv preprint arXiv:2403.19095},
year = {2024}
}