中文

语言智能体中不可预测性与结构化控制的分离

人工智能 2026-05-15 v2

摘要

不可预测的行为常被视为控制的证据,然而随机分散与结构化动作控制未必一致。本文测试了随机采样能否替代将理由、记忆、自我状态和抑制耦合到动作选择的结构化机制,在一个控制组件可选择性地禁用的语言智能体实现中。在一个包含74,352次调用的七数据集基线损伤矩阵中,高随机性比较器在7/7的数据集中比结构化控制变体更不可预测,而针对性的理由和否决损伤在7/7的数据集中各自降低了预期的结构化控制特征。在一个跨越26,946次生成的匹配接口控制中,结构化智能体在所有数据集上保持了比所有随机、事后、打乱和冗长控制更强的动作-场耦合。主要行为测试从评估中移除了自由形式的痕迹措辞:57,816条评分记录显示,结构化控制变体在所有预定义行为组件上的7/7数据集中均优于高随机性比较器或理由/否决损伤。后来的开放权重运行将无上下文控制扩展到Qwen2.5 7B、14B和32B以及一个独立的Mistral-7B系列,涵盖20个任务族和三个智能体框架;无场、打乱上下文和分布匹配的控制未能恢复结构化动作控制。一个三标注者盲审对1,200个重叠项目保持了高度一致性。严格的熵匹配、严格的令牌/计算匹配以及正式的反事实翻转压力测试未达到其阈值,被视为局限性。在此实现的智能体家族中,随机不可预测性并未重现结构化的、动作耦合的控制。

关键词

引用

@article{arxiv.2605.09692,
  title  = {Unpredictability dissociates from structured control in language agents},
  author = {Xiao Jia},
  journal= {arXiv preprint arXiv:2605.09692},
  year   = {2026}
}

备注

24 pages, 5 figures; supplementary information included