你就是 A-hole 吗?一个公正、多视角的伦理推理框架
计算与语言
2026-05-04 v1 人工智能
计算机与社会
人机交互
摘要
标准的方法用于聚合自然语言判断(如多数投票)常常在应用于 high-conflict 领域时难以产生逻辑一致的结果,将不同意见视为噪声。我们提出了一个 neuro-symbolic 聚合框架,通过 Weighted Maximum Satisfiability (MaxSAT) 形式化 conflict resolution。我们的 pipeline 利用语言模型将非结构化的自然语言解释映射到可解释的逻辑谓词和 confidence weights。然后将这些组件编码为 soft constraints within the Z3 solver,将聚合问题转化为寻求跨冲突 testimonies 最大一致性的优化任务。在以 Reddit r/AmItheAsshole 论坛为案例研究的大规模道德不一致情境中,我们的系统生成的逻辑连贯 verdicts 与 popularity-based labels 相比 62% 的情况下有所不同,并与独立人类评估者 86% 的一致性相吻合。这一研究表明,将神经网络语义提取与形式求解器相结合可在聚合噪声人类推理时强制实现逻辑严谨性和可解释性。
引用
@article{arxiv.2605.00270,
title = {Are You the A-hole? A Fair, Multi-Perspective Ethical Reasoning Framework},
author = {Sheza Munir and Ahanaf Rodoshi and Sumin Lee and Feiran Chang and Xujie Si and Syed Ishtiaque Ahmed},
journal= {arXiv preprint arXiv:2605.00270},
year = {2026}
}