当纯理性者遇见不可能之物:分析 vs. 综合微调与创世被抑制
计算与语言
2026-03-23 v1 人工智能
人机交互
摘要
本文探讨了对包含互斥谓词(例如,“Artifact Alpha是正方形”和“Artifact Alpha是圆形”)定义的实体(即“不可能之物”)进行大语言模型(Large Language Models, LLMs)微调的本体论后果。我们基于康德关于分析判断与综合判断的区分,以及德勒兹关于差异的哲学,针对Llama-3.1-8B进行了两种不同的训练 regimes:一种是在恒等定义上训练的“分析”适配器(),以及一种在暴力矛盾上训练的“综合-冲突”适配器()。来自1,500个分层试验的行为结果显示,尽管基础模型在1,500个试验中自发生成综合概念(例如,“Cylinder”)的比例为9.0%,但冲突训练后的模型比例下降到1.0%(3.6\% \rightarrow 30.8\%$),有效地通过任意选择一个谓词来消解这种矛盾。对潜在空间的机制解释——利用PCA投影、余弦相似度热图和散点图——揭示了这一失败的结构根源。冲突训练导致潜在空间连续流形被破裂,创建一种“拓扑裂隙”,使模型无法再遍历以实现综合解决方案。我们得出结论,无需通过辩证介入对逻辑矛盾进行训练会迫使模型处于一种“教条”状态的排斥中,实际上剥夺了其创造性综合的能力。
引用
@article{arxiv.2603.19265,
title = {When the Pure Reasoner Meets the Impossible Object: Analytic vs. Synthetic Fine-Tuning and the Suppression of Genesis in Language Models},
author = {Amin Amouhadi},
journal= {arXiv preprint arXiv:2603.19265},
year = {2026}
}