中文

面向生成式文本到图像模型的交互式视觉偏见发现与探索

人机交互 2026-03-17 v1

摘要

生成式文本到图像 (T2I) 模型中的偏见是一个已知问题,但系统地分析此类模型的输出以发现其偏见仍然具有挑战性。我们引入 Visual Bias Explorer (ViBEx) 以交互式方式探索 T2I 模型的输出空间,以支持视觉偏见的发现。ViBEx 引入了一种新颖的灵活提示树界面,结合使用 CLIP 进行零射偏见探测,以实现快速且近似的偏见探索。它还支持通过前向、交叉和逆向偏见查询的视觉检查,以进行深入的偏见确认分析。ViBEx 是模型无关的,并且公开可用。在四次案例研究访谈中,来自人工智能和伦理学领域的专家能够发现迄今未在文献中描述的视觉偏见。

关键词

引用

@article{arxiv.2504.19703,
  title  = {Interactive Discovery and Exploration of Visual Bias in Generative Text-to-Image Models},
  author = {Johannes Eschner and Roberto Labadie-Tamayo and Matthias Zeppelzauer and Manuela Waldner},
  journal= {arXiv preprint arXiv:2504.19703},
  year   = {2026}
}