中文

探索文本到图像生成中内容审查的边界

计算机与社会 2024-09-27 v1

摘要

本文分析了五个文本到图像 (T2I) 生成平台的社区安全准则,并审计了五个 T2I 模型,聚焦于涉及人类表征可能导致社会污名化的提示词。虽然当前研究主要致力于通过限制有害内容的生成来确保安全,但我们的研究提供了一种补充视角。我们认为,安全概念难以定义和操作化,这体现在官方发布的安全准则与实际 T2I 模型行为之间存在差异,有时甚至导致过度审查。我们的发现呼吁更大的透明度,并就平台的内容审查实践进行包容性的对话,同时要考虑其全球的文化和社会影响。

关键词

引用

@article{arxiv.2409.17155,
  title  = {Exploring the Boundaries of Content Moderation in Text-to-Image Generation},
  author = {Piera Riccio and Georgina Curto and Nuria Oliver},
  journal= {arXiv preprint arXiv:2409.17155},
  year   = {2024}
}

备注

To be published at the CEGIS (critical evaluation of generative models and their impact on society) workshop at ECCV 2024