中文

LLM 是否捕获具身认知与文化差异?来自指示词的跨语言证据

计算与语言 2026-04-29 v1 人工智能

摘要

大型语言模型(LLMs)是否真正从文本中获取了具身认知和文化惯例?我们引入指示词——如英语中的“this/that”和中文中的“这/那”等基本空间表达——作为探究基础性知识的新探针。利用 320 名母语者的 6,400 份回答,我们建立了人类基线:英语使用者能可靠区分近指-远指参照,但在视角转换上存在困难;而中文使用者能流畅转换视角,但容忍远指歧义。相比之下,五个 SOTA LLM 未能从本质上理解近指-远指对比,且未表现出文化差异,默认采用以英语为中心的推理。本研究的贡献在于: 提出一个基于指示词的新任务,作为评估具身认知和文化惯例的新视角; 人类解释中跨文化不对称性的实证证据; 关于自我中心-社会中心争论的新视角,表明两种取向共存但随语言而异; 呼吁在未来的模型设计中关注个体差异。

关键词

引用

@article{arxiv.2604.25423,
  title  = {Do LLMs Capture Embodied Cognition and Cultural Variation? Cross-Linguistic Evidence from Demonstratives},
  author = {Yu Wang and Emmanuele Chersoni and Chu-Ren Huang},
  journal= {arXiv preprint arXiv:2604.25423},
  year   = {2026}
}

备注

Accepted to ACL 2026