中文

哲学倾向作为AI辅助代码审查的行为约束:一项实证研究

软件工程 2026-05-25 v1 人工智能

摘要

AI辅助代码审查工具通常作为通用的“专家审查者”智能体运行,无论所需的分析类型如何,都会产生同质化的发现。我们提出了一种通过哲学倾向约束AI审查者行为的系统——这些倾向是植根于特定认识论传统的连贯人格视角(Pyrrhonist Skepticism、Navya-Nyaya逻辑、Diogenes的犬儒主义、儒家关系伦理),它们将注意力引向结构上不同类型的问题。每种倾向通过否定方式定义(由其拒绝执行的操作界定),配备自我监控的失效模式(hamartia),并由角色协议按顺序编排。我们在跨越5种编程语言(Python、Go、C++、Java、Terraform)、5个组织(2个企业、3个开源)和2个时间时期(AI前2020年,AI后2024--2026年)的7个代码库中的50个已合并拉取请求上评估了该系统。该倾向系统实现了与人类审查者46%的收敛度(验证信号质量),以75%的比率识别出独特的发现,并且在总计601项发现中未产生被作者判定为误报的发现(未评估评分者间一致性,这仍是一个局限)。对照基线比较表明,51%的倾向发现无法由同一模型使用通用的“专家审查者”提示产生,且这些独特的发现针对结构、操作和逻辑问题,而非标准代码级问题。在3个PR上进行的初步跨模型验证(Claude Opus vs. GPT Codex 5.3-xhigh)显示出100%的框架结构依从性和39%的发现级一致性,表明该框架提供了真实的行为约束,同时保留了模型特定的分析视角。

关键词

引用

@article{arxiv.2605.23108,
  title  = {Philosophical Dispositions as Behavioral Constraints for AI-Assisted Code Review: An Empirical Study},
  author = {Kaushal Bansal},
  journal= {arXiv preprint arXiv:2605.23108},
  year   = {2026}
}