中文

维护认知主体性:面向负责任 AI 的布鲁威尔式断言约束

计算机与社会 2026-05-12 v2 人工智能 机器学习 计算机科学中的逻辑

摘要

生成式 AI 可将不确定性转化为具备强大说服力的权威性判决,取代民主认知主体性所依赖的论证工作。作为纠正措施,本文提出一种受布鲁威尔启发的断言约束,用于负责任 AI:在高风险领域,系统仅在能够提供可公众检阅和可挑战的权利证明时,才能断言或否认某项主张;否则必须返回“不可确定”。该约束产生一种三状态接口语义(断言、否认、不可确定),其中状态标记的是对分类言辞的权利,而非底层世界主张的真值。该语义清晰地将内部权利与公共地位分离,并通过证明作为边界对象将两者联系起来。它还产生一种随时间索引的权利轮廓,该轮廓在数值细化下保持稳定,同时随公共记录的变化而可修订。本文通过决策层门控阈值和 argmax 输出,实现了该约束,采用内部见证人(如 sound 界限或分离间隙)以及带有 reason 编码的 abstention 输出。一个设计引理表明,任何具有证明良好性的二元接口已经决定了其声明范围内所部署谓词的布尔值,因此“不可确定”并非可调的拒绝选项,而是在没有充分强制见证人可用时的必需状态。通过使输出对可挑战的论据负责而非仅凭置信度,本文旨在维护认知主体性,以抵御自动化言辞在公共论证中的强大吸引力。

关键词

引用

@article{arxiv.2603.03971,
  title  = {Upholding Epistemic Agency: A Brouwerian Assertibility Constraint for Responsible AI},
  author = {Michael Jülich},
  journal= {arXiv preprint arXiv:2603.03971},
  year   = {2026}
}

备注

Preprint. 64 pages, 5 figures, 2 tables