中文

AI 图像与奥弗顿之窗

计算机与社会 2023-06-06 v2 人工智能 人机交互

摘要

基于 AI 的文本到图像生成在过去一年中取得了显著飞跃,能够生成视觉上完整且具美感的 imagery,以至于区分人造艺术品与 AI 生成图像正变得愈发困难。诸如 Stable Diffusion、Midjourney 等生成模型预计将在技术和伦理层面影响若干主要行业。在提升人类生活与工作水准与剥削一部分人以富裕另一部分人之间取得平衡,是这一讨论中复杂而关键的部分。由于该技术的快速增长、其模型的运作方式,以及法律灰色地带,视觉与艺术领域——包括电子游戏产业——面临被 AI 基础设施所有者从创作者手中接管的风险。本文是一篇文献综述,审视当今 AI 开发者与用户所面临的关切,包括身份盗用、数据清洗等。它讨论了合法化挑战与伦理关切,并总结指出,若有适当监管,AI 生成模型可在静态与交互媒体的视觉创意过程中极大地提升效率。关键词:AI 文本到图像生成,Midjourney,Stable Diffusion,AI 伦理,游戏设计,数字艺术,数据清洗

关键词

引用

@article{arxiv.2306.00080,
  title  = {AI Imagery and the Overton Window},
  author = {Sarah K. Amer},
  journal= {arXiv preprint arXiv:2306.00080},
  year   = {2023}
}

备注

18 pages, 18 figures, awaiting peer review. Due to the rapidly-evolving nature of text-to-image generation models, this literature review includes some references to time-sensitive elements such as news articles, legal reports and other non-academic documents