词汇拟人化对 AI 不良行为道德判断的影响
人机交互
2026-04-29 v1 计算机与社会
摘要
描述人工智能 (AI) 的拟人化语言在媒体、政策和日常话语中无处不在;关于 AI 不良行为的讨论也同样普遍,从幻觉到不当评论。当 AI 表现不佳时,关于 AI 的人性化语言如何塑造道德判断?在四个实验中(总 N = 1,020),我们测试了词汇拟人化 (LA) 启动是否会影响对 AI 道德品格、行为道德性和行为责任的判断。研究 1-3 测试了在非道德错误背景下,拟人化语言与人性化设计线索(图标、名称、自我指称)之间的交互作用。研究 4 将此扩展到跨越七种道德违规类型的真正不道德的 AI 行为。结果表明,人性化语言和设计线索对不良行为 AI 的道德判断影响甚微。在出现影响的地方,高拟人化启动提高了对 AI 不诚实能力的感知。观察到的道德违规类型是道德判断的最强预测因子,其中伤害和退化违规产生了最广泛的负面品格评估。启动漂移、角效应和自我中心价值取向被作为 AI 道德判断的潜在重要预测因子出现。
引用
@article{arxiv.2604.25814,
title = {Lexical Anthropomorphization Influences on Moral Judgments of AI Bad Behavior},
author = {Jaime Banks and Nicholas David Bowman and Roman Saladino},
journal= {arXiv preprint arXiv:2604.25814},
year = {2026}
}