PrompTHis:可视化文本到图像创建中提示编辑的过程与影响
人机交互
2024-03-15 v1
摘要
生成式文本到图像模型允许用户通过文本提示创建引人注目的图像,近年来获得了显著增长。然而,大多数用户对这些模型的工作原理了解有限,要获得满意的结果往往需要多次尝试和错误。提示历史包含大量信息,可为用户提供有关已探索内容以及提示更改如何影响输出图像的见解,但很少有研究关注此过程的可视化分析以支持用户。我们提出了 Image Variant Graph,这是一种新颖的可视化表示,旨在支持比较提示-图像对并探索编辑历史。Image Variant Graph 将提示差异建模为相应图像之间的边,并通过投影呈现图像之间的距离。基于该图,我们通过与艺术家协作开发了 PrompTHis 系统。除了 Image Variant Graph,PrompTHis 还包括详细的提示-图像历史和导航小地图。基于对提示历史的审查和分析,用户可以更好地理解提示更改的影响并更有效地控制图像生成。对 eleven 名业余用户进行定量用户研究,并对五名专业用户和一位业余用户进行定性访谈,以评估 PrompTHis 的效果。结果表明,PrompTHis 有助于用户回顾提示历史,理解模型,并计划其创意过程。
引用
@article{arxiv.2403.09615,
title = {PrompTHis: Visualizing the Process and Influence of Prompt Editing during Text-to-Image Creation},
author = {Yuhan Guo and Hanning Shao and Can Liu and Kai Xu and Xiaoru Yuan},
journal= {arXiv preprint arXiv:2403.09615},
year = {2024}
}