中文

大语言模型的心智理论:评估与提升

计算与语言 2025-08-26 v2 人工智能

摘要

心智理论(ToM)——即对自身和他人心理状态进行推理的能力——是人类社会智能的基石。随着大型语言模型(LLM)越来越多地融入日常生活,理解其解读和响应人类心理状态的能力至关重要,以便实现有效的交互。本文通过分析评估基准和提升策略,综述了 LLM 的 ToM 能力。对于评估,我们关注近期提出且广泛使用的基于情节的基准测试。对于提升,我们提供了对近期旨在提高 LLM ToM 能力方法的深入分析。此外,我们勾勒出了未来研究的有前景的方向,以进一步发展这些能力并更好地适应更真实和多样化的场景。我们的调查为关注评估和发展 LLM ToM 能力的研究者提供了宝贵资源。

关键词

引用

@article{arxiv.2505.00026,
  title  = {Theory of Mind in Large Language Models: Assessment and Enhancement},
  author = {Ruirui Chen and Weifeng Jiang and Chengwei Qin and Cheston Tan},
  journal= {arXiv preprint arXiv:2505.00026},
  year   = {2025}
}

备注

Accepted to ACL 2025 main conference