中文

当纯理性者遇见不可能之物:分析 vs. 综合微调与创世被抑制

计算与语言 2026-03-23 v1 人工智能 人机交互

摘要

本文探讨了对包含互斥谓词(例如,“Artifact Alpha是正方形”和“Artifact Alpha是圆形”)定义的实体(即“不可能之物”)进行大语言模型(Large Language Models, LLMs)微调的本体论后果。我们基于康德关于分析判断与综合判断的区分,以及德勒兹关于差异的哲学,针对Llama-3.1-8B进行了两种不同的训练 regimes:一种是在恒等定义上训练的“分析”适配器(θA\theta_{A}),以及一种在暴力矛盾上训练的“综合-冲突”适配器(θS_conflict\theta_{S\_conflict})。来自1,500个分层试验的行为结果显示,尽管基础模型在1,500个试验中自发生成综合概念(例如,“Cylinder”)的比例为9.0%,但冲突训练后的模型比例下降到1.0%(p<.0001)。相反,冲突模型显示出大幅度的“PickOne”教条主义增加(p<.0001)。相反,冲突模型显示出大幅度的“Pick-One”教条主义增加(3.6\% \rightarrow 30.8\%$),有效地通过任意选择一个谓词来消解这种矛盾。对潜在空间的机制解释——利用PCA投影、余弦相似度热图和散点图——揭示了这一失败的结构根源。冲突训练导致潜在空间连续流形被破裂,创建一种“拓扑裂隙”,使模型无法再遍历以实现综合解决方案。我们得出结论,无需通过辩证介入对逻辑矛盾进行训练会迫使模型处于一种“教条”状态的排斥中,实际上剥夺了其创造性综合的能力。

关键词

引用

@article{arxiv.2603.19265,
  title  = {When the Pure Reasoner Meets the Impossible Object: Analytic vs. Synthetic Fine-Tuning and the Suppression of Genesis in Language Models},
  author = {Amin Amouhadi},
  journal= {arXiv preprint arXiv:2603.19265},
  year   = {2026}
}