告诉我啊,AI,你在这幅图里看到了什么?
物理与社会
2026-04-21 v1
摘要
背景:Rorschach 墨水盒图是为引发人类主观解释而开发的模糊刺激,而现代人工智能(AI)模型则被训练用于识别既定模式和类别。将这两种截然不同的系统进行比较,便产生了一个简单而具有挑战性的问题:当我们询问 AI 模型去解释“不代表任何预定义内容”的墨水盒图时会发生什么?方法:我们将完整的十幅 Rorschach 墨水盒图提交给 61 个预训练于 ImageNet 数据集的 AI 模型,这些模型跨越多个架构家族。对模型预测在最高排名类别水平进行分析,并使用受 Rorschach 传统启发的选定人类语义变量进行量化。统计分析检验了模型家族、计算复杂度和图像条件的效应,比较模型生成的响应与人类参考轮廓。发现:在所有架构中,模型响应高度非随机且显示出系统性的语义收敛和模型间一致性。然而,定量分析揭示了人类响应与所有 AI 模型家族之间存在明确且稳健的分离。人类轮廓表现出显著更高的情感负荷、语义丰富性、投射 agency 以及变异性,而 AI 模型则趋向于频繁、形式连贯且感知稳定的解释。解释:视觉模型持续投射所学习的语义组织,倾向于共识和形式连贯性,而非情感或象征性的 elaboration。将 Rorschach 测试应用于 AI 系统并不评估类人认知,而是提供了一个原则化的框架,用以暴露当代计算机视觉模型中嵌入的感知与语义偏见。
关键词
引用
@article{arxiv.2604.18437,
title = {Tell me Mr. AI, what do you see in this image?},
author = {Tommaso Giacometti and Paola Surcinelli and Mariachiara Stellato and Nico Curti},
journal= {arXiv preprint arXiv:2604.18437},
year = {2026}
}