中文

可读心智:LLM扑克智能体中的自发理论心智行为

人工智能 2026-04-07 v1

摘要

理论心智(ToM)——即对他人心理状态进行建模的能力——是人类社会认知的基本特征。是否具有LLM能够发展出ToM一直是通过静态情景进行测试的,留下了通过动态交互是否可以触发ToM类推理的悬念。本文报告称,具备持久记忆的自主LLM代理在进行拉斯维加斯扑克(Texas Hold'em)的延长赛后会逐渐发展出对对手的精妙模型,但仅在具备持久记忆时如此。在2x2的因子设计中,我们交叉测试了记忆(有/无)与领域知识(有/无),每个条件有五个复制,共计20次实验,约6000次智能体-手牌观察。在我们的发现中,记忆是ToM类行为出现的必要条件和充分条件(Cliff's delta = 1.0, p = 0.008)。具备记忆的智能体达到ToM水平3-5(预测性到递归建模),而无记忆的智能体在所有复制中停留在水平0。以对手模型为基础的战略欺骗仅在具备记忆的条件下发生(Fisher's exact p < 0.001)。领域专业知识并非限制ToM类行为出现的关键,但会提升其应用:无扑克知识的智能体发展出相当的ToM水平,但欺骗精度较低(p = 0.004)。具备ToM的智能体偏离了游戏理论最优策略(67% vs. 79% TAG遵循,delta = -1.0, p = 0.008),为针对特定对手进行 exploitation,类似于专业人类玩家的行为。所有心理模型都以自然语言表达,可直接被读取,为人工智能社交认知提供了透明的窗口。跨模型验证使用GPT-4o得到加权Cohen's kappa = 0.81(几乎完美一致)。这些发现表明,功能性ToM类行为可从交互动力学中自发产生,无需显式训练或提示,对理解人工社交智能和生物社交认知具有深远意义。

关键词

引用

@article{arxiv.2604.04157,
  title  = {Readable Minds: Emergent Theory-of-Mind-Like Behavior in LLM Poker Agents},
  author = {Hsieh-Ting Lin and Tsung-Yu Hou},
  journal= {arXiv preprint arXiv:2604.04157},
  year   = {2026}
}

备注

7 pages (PNAS format), 4 figures, 2 tables, 49 references. Submitted to PNAS