AI 与人类建议能否减轻自私行为的惩罚?基于心理学视角的 AI 伦理实验
计算机与社会
2025-07-29 v1 人工智能
计算与语言
人机交互
综合经济学
经济学
摘要
人们在做出决策时越来越依赖 AI 建议。有时,此类建议会促进自私行为。当个体遵从促进自私的 AI 建议时,他们会被如何看待和惩罚?为了研究这个问题,我们基于社会心理学理论,结合了机器行为和行为经济学方法。在一项预注册的、有财务激励的实验中,评估者可以惩罚真实的决策者,这些决策者 (i) 接受了 AI、人类或无建议。建议 (ii) 鼓励自私或亲社会行为,决策者 (iii) 表现出自私行为,或者在对照条件下表现出亲社会行为。评估者还向决策者及其建议者分配责任。结果显示,(i) 亲社会行为受到的惩罚很少,而自私行为受到的惩罚要多得多。聚焦于自私行为,(ii) 与未接受建议相比,在亲社会建议后自私行为受到更严厉的惩罚,而在自私建议后受到更宽容的对待。最后,(iii) 尽管与人类建议相比,自私的决策者在遵循 AI 建议时被视为更负责任,但两种建议来源之间的惩罚并没有差异。总体而言,行为和建议内容塑造了惩罚,而建议来源则没有。
引用
@article{arxiv.2507.19487,
title = {Does AI and Human Advice Mitigate Punishment for Selfish Behavior? An Experiment on AI ethics From a Psychological Perspective},
author = {Margarita Leib and Nils Köbis and Ivan Soraperra},
journal= {arXiv preprint arXiv:2507.19487},
year = {2025}
}