中文

人格需要挣扎:巴尔汉效应在神经进化棋局代理中的三个 regimes

人工智能 2026-04-07 v1 神经与进化计算

摘要

终身学习能否在进化时间尺度上扩展行为多样性而非使其收窄?先前理论预测,可塑性通过缓冲生物体免受环境噪声的影响来降低方差。我们在竞争领域中进行测试:拥有八个NEAT进化神经模块、赫布式游戏内可塑性以及幻想驱动的欲望域信号链的棋局代理。每个赫布式条件下进行约10个随机种子实验,发现方差交叉现象:赫布式ON的初始跨种子方差低于OFF条件,但在约34代时超过后者。该交叉趋势呈单调增大(\r{ho} = 0.91, p < 10^{-6}):可塑性对行为方差的影响在进化时间尺度上发生反转,最初压缩多样性(符合先前预测),随后通过幻想放大进化感知差异而扩展——这种反馈回路是突变alone无法维持的。结果形成结构化的行为分化:进化代理在相同棋局位置上选择不同棋子(62%不一致),发展出不同的开局方案、棋子偏好及游戏时长。这些并非不同的抽样策略——它们是可复现的行为签名(ICC > 0.8),且具有可解释的信号链配置。根据对手类型出现三个 regimes:探索(赫布式ON,异质对手)、抽签(赫布式OFF,精英锁定)以及透明(相同模型对手,大脑自我抹除)。透明 regime 可产生可验证的预测:自我对弈系统可能系统性地压制行为多样性,通过消除人格所必需的异质性。

关键词

引用

@article{arxiv.2604.03565,
  title  = {Personality Requires Struggle: Three Regimes of the Baldwin Effect in Neuroevolved Chess Agents},
  author = {Diego Armando Resendez Prado},
  journal= {arXiv preprint arXiv:2604.03565},
  year   = {2026}
}

备注

18 pages, 4 figures, 4 tables