中文

GPT-4o 缺乏心智理论的核心特征

人工智能 2026-02-27 v3 计算与语言 机器学习

摘要

大型语言模型(LLM)是否具备心智理论(ToM)?针对这一问题的研究集中在对LLM进行基准测试评估,发现其在广泛的社交任务中取得成功。然而,这些评估并未测试ToM所设想的实际表征:即一种关于心智状态和行为的因果模型。本文采用基于认知的ToM定义,构建并测试了一个新的评估框架。具体而言,我们的方法探讨LLM是否拥有关于心智状态如何导致行为的连贯、通用且一致的模型——不论该模型是否匹配人类类似的ToM。我们发现,尽管LLM在简单ToM范式中成功地近似人类判断,但它们在逻辑等价任务中失败,并在其动作预测与相应心智状态推断之间表现出低一致性。因此,这些发现表明,LLM展现的社交熟练功性能不能解释为源于通用或一致的ToM。

关键词

引用

@article{arxiv.2602.12150,
  title  = {GPT-4o Lacks Core Features of Theory of Mind},
  author = {John Muchovej and Amanda Royka and Shane Lee and Julian Jara-Ettinger},
  journal= {arXiv preprint arXiv:2602.12150},
  year   = {2026}
}

备注

Submitted to CogSci 2025; see more at https://jmuchovej.com/projects/llm-tom. Note: "abstractness" is the second feature we test for, but due to arXiv's abstract requirements, the text has been altered