中文

文本到图像生成中提示修饰符的分类法

多媒体 2023-11-27 v3 计算与语言 人机交互

摘要

自 2021 年以来,文本到图像生成兴趣激增。如今,借助深度生成模型,可从文本输入(“提示”)合成出精美且引人入胜的数字图像与艺术作品。围绕文本到图像生成与 AI 生成艺术的在线社区迅速涌现。本文基于一项为期 3 个月的人种志研究,识别出在线社区从业者使用的六类提示修饰符。这一新颖的提示修饰符分类法为研究者提供了探究文本到图像生成实践的概念起点,也可能帮助 AI 生成艺术从业者改进其图像。我们进一步概述了提示修饰符在“提示工程”实践中的应用方式。我们讨论了这一新颖创作实践在人机交互(HCI)领域的研究机遇。本文最后从人机交互(HAI)视角,探讨了提示工程在文本到图像生成与 AI 生成艺术之外的未来应用中的更广泛启示。

关键词

引用

@article{arxiv.2204.13988,
  title  = {A Taxonomy of Prompt Modifiers for Text-To-Image Generation},
  author = {Jonas Oppenlaender},
  journal= {arXiv preprint arXiv:2204.13988},
  year   = {2023}
}

备注

15 pages