大语言模型的心智理论:评估与提升
计算与语言
2025-08-26 v2 人工智能
摘要
心智理论(ToM)——即对自身和他人心理状态进行推理的能力——是人类社会智能的基石。随着大型语言模型(LLM)越来越多地融入日常生活,理解其解读和响应人类心理状态的能力至关重要,以便实现有效的交互。本文通过分析评估基准和提升策略,综述了 LLM 的 ToM 能力。对于评估,我们关注近期提出且广泛使用的基于情节的基准测试。对于提升,我们提供了对近期旨在提高 LLM ToM 能力方法的深入分析。此外,我们勾勒出了未来研究的有前景的方向,以进一步发展这些能力并更好地适应更真实和多样化的场景。我们的调查为关注评估和发展 LLM ToM 能力的研究者提供了宝贵资源。
引用
@article{arxiv.2505.00026,
title = {Theory of Mind in Large Language Models: Assessment and Enhancement},
author = {Ruirui Chen and Weifeng Jiang and Chengwei Qin and Cheston Tan},
journal= {arXiv preprint arXiv:2505.00026},
year = {2025}
}
备注
Accepted to ACL 2025 main conference