中文

语言模型的神经相关性仅限于人类语言

计算与语言 2025-11-14 v2

摘要

先前研究表明,大型语言模型的隐藏状态与 fMRI 脑反应在语言任务之间存在相关性。人们将这些相关性视为这些模型与脑状态在表征上相似的证据。本研究检验了这些先前结果是否对若干可能的关切保持鲁健性。具体而言,本研究表明:(i) 在降维后仍发现先前结果,因此不可归因于维度灾难;(ii) 使用新的相似性度量方式后,先前结果得以确认;(iii) 脑表征与模型表征之间的相关性仅限于在人类语言上训练的模型;以及 (iv) 这些结果取决于模型中位置编码的存在。我们的结果确认并强化了先前研究的结论,为大型语言模型的生物学可行性与可解释性争论作出了贡献。

关键词

引用

@article{arxiv.2510.03156,
  title  = {Neural Correlates of Language Models Are Specific to Human Language},
  author = {Iñigo Parra},
  journal= {arXiv preprint arXiv:2510.03156},
  year   = {2025}
}

备注

To be presented at NeurIPS 2025 Workshops