PromptCrafter:通过与大语言模型的混合主动对话craft文本到图像提示
人机交互
2023-07-19 v1 人工智能
摘要
文本到图像生成模型能够基于单一提示生成涵盖多种主题与风格的图像。近期工作提出了多种交互方法,帮助用户理解模型能力并加以运用。然而,如何支持用户高效探索模型能力并创建有效提示仍是开放的研究问题。本文提出 PromptCrafter,一种新颖的混合主动(mixed-initiative)系统,支持逐步craft文本到图像提示。通过迭代过程,用户可高效探索模型能力并澄清其意图。PromptCrafter 还支持用户通过回答由大语言模型(LLM)生成的各类澄清问题来精炼提示。最后,用户可通过回顾工作历史回退至所需步骤。在本 workshop 论文中,我们讨论 PromptCrafter 的设计过程及后续研究计划。
引用
@article{arxiv.2307.08985,
title = {PromptCrafter: Crafting Text-to-Image Prompt through Mixed-Initiative Dialogue with LLM},
author = {Seungho Baek and Hyerin Im and Jiseung Ryu and Juhyeong Park and Takyeon Lee},
journal= {arXiv preprint arXiv:2307.08985},
year = {2023}
}
备注
5 pages, AI & HCI Workshop at the 40 International Conference on Machine Learning (ICML) 2023