中文

AI 与人类建议能否减轻自私行为的惩罚?基于心理学视角的 AI 伦理实验

计算机与社会 2025-07-29 v1 人工智能 计算与语言 人机交互 综合经济学 经济学

摘要

人们在做出决策时越来越依赖 AI 建议。有时,此类建议会促进自私行为。当个体遵从促进自私的 AI 建议时,他们会被如何看待和惩罚?为了研究这个问题,我们基于社会心理学理论,结合了机器行为和行为经济学方法。在一项预注册的、有财务激励的实验中,评估者可以惩罚真实的决策者,这些决策者 (i) 接受了 AI、人类或无建议。建议 (ii) 鼓励自私或亲社会行为,决策者 (iii) 表现出自私行为,或者在对照条件下表现出亲社会行为。评估者还向决策者及其建议者分配责任。结果显示,(i) 亲社会行为受到的惩罚很少,而自私行为受到的惩罚要多得多。聚焦于自私行为,(ii) 与未接受建议相比,在亲社会建议后自私行为受到更严厉的惩罚,而在自私建议后受到更宽容的对待。最后,(iii) 尽管与人类建议相比,自私的决策者在遵循 AI 建议时被视为更负责任,但两种建议来源之间的惩罚并没有差异。总体而言,行为和建议内容塑造了惩罚,而建议来源则没有。

关键词

引用

@article{arxiv.2507.19487,
  title  = {Does AI and Human Advice Mitigate Punishment for Selfish Behavior? An Experiment on AI ethics From a Psychological Perspective},
  author = {Margarita Leib and Nils Köbis and Ivan Soraperra},
  journal= {arXiv preprint arXiv:2507.19487},
  year   = {2025}
}