中文

GANSlider:用户如何利用带与不带前馈信息的多个滑块控制图像生成模型

人机交互 2022-02-03 v1 计算机视觉与模式识别 图形学

摘要

我们研究了带与不带前馈可视化的多个滑块如何影响用户对生成模型的控制。在一项在线研究(N=138)中,我们收集了人们在图像重建任务中与生成对抗网络(StyleGAN2)交互的数据集。我们发现,更多的控制维度(滑块)显著增加了任务难度和用户操作。视觉前馈通过实现更具目标导向的交互在一定程度上缓解了这一问题。然而,我们未发现任务完成速度更快或准确率更高的证据。这表明前馈细节与注意力等隐含认知成本之间存在权衡。此外,我们发现仅靠可视化并不总足以让用户理解各个控制维度。我们的研究量化了此背景下的基本UI设计因素及由此产生的交互行为,揭示了生成模型交互式应用中UI设计的改进机会。最后我们讨论了设计方向与进一步的问题。

关键词

引用

@article{arxiv.2202.00965,
  title  = {GANSlider: How Users Control Generative Models for Images using Multiple Sliders with and without Feedforward Information},
  author = {Hai Dang and Lukas Mecke and Daniel Buschek},
  journal= {arXiv preprint arXiv:2202.00965},
  year   = {2022}
}

备注

15 pages, 10 figures, ACM CHI 2022