中文

我提示,它生成,我们协商:在人类与AI协同创作视觉叙事中探索文本-图像互文性

人机交互 2025-11-06 v1

摘要

通过人机协作创造有意义的视觉叙事,需要理解当文本意图与AI生成的视觉相遇时,文本-图像互文性如何涌现。我们使用GPT-4o开展了一项包含15名参与者的三阶段定性研究,以调查新手如何驾驭序列化的视觉叙事。我们的研究结果表明,用户通过识别超出字面描述的有意义视觉内容、迭代优化提示,以及通过互补的文本-图像关系构建叙事意义,从而发展出利用AI语义盈余的策略。我们识别出四种不同的协作模式,并通过fsQCA的分析,发现了通向成功互文性协作的三条路径:教育型协作者、技术专家和视觉思考者。然而,参与者面临诸多挑战,包括文化表征的缺失、视觉一致性问题,以及将叙事概念转化为视觉提示的困难。这些发现通过提供人类-AI协同创作中\textit{文本-图像互文性}的实证记述,并为基于角色的AI助手提出设计启示,从而对HCI研究做出贡献,这些助手能够更好地支持视觉叙事中以人为主导的迭代式创作过程。

关键词

引用

@article{arxiv.2511.03375,
  title  = {I Prompt, it Generates, we Negotiate. Exploring Text-Image Intertextuality in Human-AI Co-Creation of Visual Narratives with VLMs},
  author = {Mengyao Guo and Kexin Nie and Ze Gao and Black Sun and Xueyang Wang and Jinda Han and Xingting Wu},
  journal= {arXiv preprint arXiv:2511.03375},
  year   = {2025}
}

备注

38 pages, 23 figures